load data service
()
| 146 | |
| 147 | |
| 148 | def load_data_service(): |
| 149 | """ |
| 150 | load data service |
| 151 | """ |
| 152 | global llm_engine |
| 153 | if llm_engine is not None: |
| 154 | return llm_engine |
| 155 | api_server_logger.info(f"FastDeploy LLM API server starting... {os.getpid()}, port: {args.port}") |
| 156 | engine_args = EngineArgs.from_cli_args(args) |
| 157 | config = engine_args.create_engine_config() |
| 158 | api_server_logger.info(f"local_data_parallel_id: {config.parallel_config}") |
| 159 | expert_service = ExpertService(config, config.parallel_config.local_data_parallel_id) |
| 160 | if not expert_service.start(args.port, config.parallel_config.local_data_parallel_id): |
| 161 | api_server_logger.error("Failed to initialize FastDeploy LLM expert service, service exit now!") |
| 162 | return None |
| 163 | llm_engine = expert_service |
| 164 | return expert_service |
| 165 | |
| 166 | |
| 167 | @asynccontextmanager |
no test coverage detected