(msg)
| 244 | |
| 245 | |
| 246 | def run_llm(msg): |
| 247 | # vllm |
| 248 | prompt_token_ids = [tokenizer.apply_chat_template(messages, add_generation_prompt=True) for messages in [msg]] |
| 249 | |
| 250 | outputs = llm.generate(prompt_token_ids=prompt_token_ids, sampling_params=sampling_params) |
| 251 | |
| 252 | completion = [output.outputs[0].text for output in outputs] |
| 253 | |
| 254 | return completion[0] |
| 255 | |
| 256 | responses = [] |
| 257 | trajectories = [] |