↓ 2 callersFunctiongenerate_stream(
model,
tokenizer,
params: Dict,
device: str,
context_len: int,
stream_interval: int
fastchat/serve/inference.py:62
↓ 2 callersFunctionopenai_api_stream_iter(
model_name,
messages,
temperature,
top_p,
max_new_tokens,
api_base=None,
api_key
fastchat/serve/api_provider.py:14