↓ 7 callersMethodprepare_inputs_labels_for_multimodal(
self, input_ids, position_ids, attention_mask, past_key_values, labels,
images, image_sizes=
llava/model/llava_arch.py:146
↓ 4 callersFunctionload_pretrained_model(model_path, model_base, model_name, load_8bit=False, load_4bit=False, device_map="auto", device="cuda", use_f
llava/model/builder.py:26
↓ 2 callersMethodprocess_image(self, image, image_process_mode, return_pil=False, image_format='PNG', max_len=1344, min_len=672)
llava/conversation.py:146