Creates an async LLM engine from the engine arguments.
(cls,
engine_args: AsyncEngineArgs,
start_engine_loop: bool = True)
| 484 | |
| 485 | @classmethod |
| 486 | def from_engine_args(cls, |
| 487 | engine_args: AsyncEngineArgs, |
| 488 | start_engine_loop: bool = True) -> "AsyncLLMEngine": |
| 489 | """Creates an async LLM engine from the engine arguments.""" |
| 490 | # Create the engine configs. |
| 491 | engine_configs = engine_args.create_engine_configs() |
| 492 | parallel_config = engine_configs[2] |
| 493 | # Initialize the cluster. |
| 494 | placement_group = initialize_cluster(parallel_config, |
| 495 | engine_args.engine_use_ray) |
| 496 | # Create the async LLM engine. |
| 497 | engine = cls(parallel_config.worker_use_ray, |
| 498 | engine_args.engine_use_ray, |
| 499 | *engine_configs, |
| 500 | placement_group, |
| 501 | log_requests=not engine_args.disable_log_requests, |
| 502 | log_stats=not engine_args.disable_log_stats, |
| 503 | max_log_len=engine_args.max_log_len, |
| 504 | start_engine_loop=start_engine_loop) |
| 505 | return engine |
nothing calls this directly
no test coverage detected