↓ 28 callersFunctionload_pretrained_model(model_path, model_base, model_name, load_8bit=False, load_4bit=False, device_map="auto", torch_dtype="float16
llava/model/builder.py:27
↓ 13 callersFunctionget_ap(predictions, labels, sim_threhold, tolerance, separator="\\t", delimiter="\\n", easy=1)
lmms-eval/lmms_eval/tasks/ocrbench_v2/TEDS_metric.py:769
↓ 13 callersMethodprepare_inputs_labels_for_multimodal(self, input_ids, position_ids, attention_mask, past_key_values, labels, images, modalities=["image"], image_s
llava/model/llava_arch.py:251
↓ 10 callersMethod__init__(self, dim, num_heads=8, qkv_bias=True, scaled_cosine=False, scale_heads=False, logit_scale_max=math.log(1.0 /
llava/model/multimodal_encoder/dev_eva_clip/eva_clip/transformer.py:156
↓ 9 callersFunction_call_chat(messages: List[Dict[str, Any]], *, max_tokens: int, temperature: float, model_override: Optional[str] = None)
lmms-eval/lmms_eval/tasks/kris_bench/utils.py:285
↓ 7 callersFunctionnum2chn(number_string, numbering_type=NUMBERING_TYPES[1], big=False, traditional=False, alt_zero=False, alt_one=False
lmms-eval/lmms_eval/tasks/librispeech/cn_tn.py:645