MCPcopy Create free account
hub / github.com/NVIDIA/TensorRT-LLM / enqueue_request

Method enqueue_request

tensorrt_llm/executor/ray_gpu_worker.py:253–256  ·  view source on GitHub ↗
(self,
                        request: GenerationRequest,
                        result_wait_queue: Queue | None = None)

Source from the content-addressed store, hash-verified

251 super().setup_engine()
252
253 def enqueue_request(self,
254 request: GenerationRequest,
255 result_wait_queue: Queue | None = None) -> int:
256 return self._enqueue_request(request, result_wait_queue)
257
258 @control_action_decorator
259 def sleep(self, sleep_tags: List[str]):

Calls 1

_enqueue_requestMethod · 0.80