↓ 10 callersMethodprepare_inputs_labels_for_multimodal(
self, input_ids, position_ids, attention_mask, past_key_values, labels, clips, clips_large, seqs, co
dispider/model/long_arch.py:136
↓ 6 callersFunctionrepeat_kv This is the equivalent of torch.repeat_interleave(x, dim=1, repeats=n_rep). The hidden states go from (batch, num_key_value_heads, seqlen, he
dispider/model/language_model/qwen_model/modeling_qwen.py:176
↓ 2 callersFunctionload_pretrained_model(model_path, model_base, model_name, load_8bit=False, load_4bit=False, device_map="auto", device="cuda", **kwa
dispider/model/builder.py:26
↓ 1 callersMethodencode_sequences(self, clips, clips_large, seqs, compress_mask, qs, qs_mask, time_labels, ans_token, todo_token, insert_positi
dispider/model/long_arch.py:104
↓ 1 callersFunctionprocess_data(video_id, scene_sep, question, model_config, tokenizer, processor, processor_large, time_tokenizer)
inference.py:138
↓ 1 callersFunctionprocess_data(video_id, scene_sep, question, candidates, model_config, image_folder, tokenizer, processor, processor_large,
dispider/eval/model_videomme_long.py:171