MCPcopy Create free account

hub / github.com/QwenLM/Qwen3-VL-Embedding / functions

Functions211 in github.com/QwenLM/Qwen3-VL-Embedding

↓ 28 callersFunctionprint_master
If distributed is initialized print only on rank 0.
src/evaluation/mmeb_v2/utils/basic_utils.py:15
↓ 19 callersFunctionload_hf_dataset
(hf_path)
src/evaluation/mmeb_v2/utils/dataset_utils.py:46
↓ 17 callersFunctionsample_dataset
(dataset, **kwargs)
src/evaluation/mmeb_v2/utils/dataset_utils.py:7
↓ 15 callersFunctionprocess_video_frames
Load and sample frames as input into the model.
src/evaluation/mmeb_v2/utils/vision_utils/vision_utils.py:273
↓ 12 callersFunctionsave_frames
Saves frames if only raw video is available.
src/evaluation/mmeb_v2/utils/vision_utils/vision_utils.py:287
↓ 10 callersMethodload
Load model from pretrained checkpoint.
src/evaluation/mmeb_v2/models.py:38
↓ 9 callersFunctionprint_rank
If distributed is initialized, print the rank.
src/evaluation/mmeb_v2/utils/basic_utils.py:8
↓ 8 callersFunction_is_tensor_video_clip
(clip)
src/evaluation/mmeb_v2/utils/vision_utils/video_transforms.py:230
↓ 6 callersFunctioncrop
Args: clip (torch.tensor): Video clip to be cropped. Size is (T, C, H, W)
src/evaluation/mmeb_v2/utils/vision_utils/video_transforms.py:240
↓ 6 callersFunctionload_frames
Load image frames from a directory, with an optional filter function.
src/evaluation/mmeb_v2/utils/vision_utils/vision_utils.py:232
↓ 5 callersFunctionresize
(clip, target_size, interpolation_mode)
src/evaluation/mmeb_v2/utils/vision_utils/video_transforms.py:250
↓ 4 callersMethodencode_input
Encode inputs using the Qwen3VL embedder. Args: inputs: Dict containing 'text', 'image', 'video', 'instruction' etc.
src/evaluation/mmeb_v2/models.py:57
↓ 3 callersMethodcompute_similarity
Compute similarity matrix between query and passage representations.
src/evaluation/mmeb_v2/models.py:119
↓ 3 callersFunctionqa_template
(question, candidates, answer)
src/evaluation/mmeb_v2/utils/vision_utils/vision_utils.py:34
↓ 2 callersMethod_dist_gather
Gather tensors across distributed processes.
src/evaluation/mmeb_v2/models.py:111
↓ 2 callersMethodaverage_precision_at_k
Compute Average Precision (AP)@K for multiple true labels. AP is the average of precision@i for i where the i-th item is relevant.
src/evaluation/mmeb_v2/utils/eval_utils/metrics.py:96
↓ 2 callersFunctioncenter_crop
(clip, crop_size)
src/evaluation/mmeb_v2/utils/vision_utils/video_transforms.py:284
↓ 2 callersMethoddevice
(self)
src/evaluation/mmeb_v2/models.py:30
↓ 2 callersFunctionencode_embeddings
Generate embeddings using MMEBEmbeddingModel's encode_input method. Supports DDP distributed gathering.
src/evaluation/mmeb_v2/eval_embedding.py:40
↓ 2 callersMethodevaluate
Evaluates predictions against true labels for a list of test cases. Handles multi-label by ensuring `label` is a list of true positiv
src/evaluation/mmeb_v2/utils/eval_utils/metrics.py:191
↓ 2 callersMethodformat_mm_content
( self, text: Optional[Union[List[str], str]] = None, image: Optional[Union[List[Union
src/models/qwen3_vl_reranker.py:225
↓ 2 callersFunctiongenerate_cand_dataset
(dataset, corpus)
src/evaluation/mmeb_v2/data/datasets/base_eval_dataset.py:79
↓ 2 callersFunctionget_short_imagename
Truncate filename and append MD5 hash to ensure path compatibility
src/evaluation/mmeb_v2/data/datasets/visrag_dataset.py:13
↓ 2 callersMethodinstantiate
(cls, dataset_parser, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/base_eval_dataset.py:47
↓ 2 callersFunctionload_qrels_mapping
Returns: { "qid1": {"docA": 2, "docB": 1}, "qid2": {"docC": 3}, ... }
src/evaluation/mmeb_v2/utils/dataset_utils.py:20
↓ 2 callersMethodndcg_at_k
Compute Normalized Discounted Cumulative Gain (NDCG@K) with optional graded relevance and exponential gain. Args: predic
src/evaluation/mmeb_v2/utils/eval_utils/metrics.py:153
↓ 2 callersFunctionpad_dataset_to_divisible
(dataset, world_size)
src/evaluation/mmeb_v2/eval_embedding.py:26
↓ 2 callersMethodprecision_at_k
Compute Precision@K for multiple true labels. Precision@K = (Number of relevant items in top K) / K
src/evaluation/mmeb_v2/utils/eval_utils/metrics.py:23
↓ 2 callersFunctionprint_table
Print table in terminal, split into multiple lines if too wide
src/evaluation/mmeb_v2/gather_results.py:190
↓ 2 callersMethodprocess
( self, inputs: Dict, )
src/models/qwen3_vl_reranker.py:379
↓ 2 callersMethodrecall_at_k
Compute Recall@K for multiple true labels. Recall@K = (Number of relevant items in top K) / (Total number of relevant items)
src/evaluation/mmeb_v2/utils/eval_utils/metrics.py:36
↓ 2 callersFunctionresize_crop_to_fill
(pil_image, image_size)
src/evaluation/mmeb_v2/utils/vision_utils/video_transforms.py:187
↓ 2 callersMethodsave
(self, output_dir: str)
src/evaluation/mmeb_v2/models.py:53
↓ 2 callersFunctionsave_tsv
Save as TSV file
src/evaluation/mmeb_v2/gather_results.py:246
↓ 1 callersMethod__init__
( self, model_name_or_path: str, max_length: int = MAX_LENGTH, min_pixels: i
src/models/qwen3_vl_embedding.py:161
↓ 1 callersMethod_get_relevant_hits_and_predicted_k
Helper function to get common elements for calculations.
src/evaluation/mmeb_v2/utils/eval_utils/metrics.py:62
↓ 1 callersMethod_pooling_last
(hidden_state: torch.Tensor, attention_mask: torch.Tensor)
src/models/qwen3_vl_embedding.py:365
↓ 1 callersMethod_pooling_last
Pool the last non-padded token.
src/evaluation/mmeb_v2/models.py:79
↓ 1 callersMethod_preprocess_inputs
(self, conversations: List[List[Dict]])
src/models/qwen3_vl_embedding.py:329
↓ 1 callersFunctionbuild_corpus_lookup
Build mapping: cand_id(str) -> candidate_sample(dict)
src/evaluation/mmeb_v2/eval_reranker.py:42
↓ 1 callersFunctioncenter_crop_arr
Center cropping implementation from ADM. https://github.com/openai/guided-diffusion/blob/8fb3ad9197f16bbc40620447b2742e13458d2831/guided_diff
src/evaluation/mmeb_v2/utils/vision_utils/video_transforms.py:170
↓ 1 callersFunctioncenter_crop_arr
Center cropping implementation from ADM. https://github.com/openai/guided-diffusion/blob/8fb3ad9197f16bbc40620447b2742e13458d2831/guided_diff
src/evaluation/mmeb_v2/utils/vision_utils/vision_utils.py:190
↓ 1 callersFunctioncenter_crop_using_short_edge
(clip)
src/evaluation/mmeb_v2/utils/vision_utils/video_transforms.py:297
↓ 1 callersFunctioncollect_results
Collect all evaluation results
src/evaluation/mmeb_v2/gather_results.py:113
↓ 1 callersMethodcompute_scores
(self, inputs: Dict)
src/models/qwen3_vl_reranker.py:133
↓ 1 callersFunctioncompute_summary
Compute summary results
src/evaluation/mmeb_v2/gather_results.py:144
↓ 1 callersFunctioncorpus_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/vidore_dataset.py:63
↓ 1 callersFunctioncorpus_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/visrag_dataset.py:68
↓ 1 callersFunctiondata_prepare
(batch_dict, **kwargs)
src/evaluation/mmeb_v2/data/datasets/youcook2_dataset.py:14
↓ 1 callersFunctiondata_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/image_qa_dataset.py:8
↓ 1 callersFunctiondata_prepare
(batch_dict, **kwargs)
src/evaluation/mmeb_v2/data/datasets/video_classification_datasets.py:16
↓ 1 callersFunctiondata_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/nextqa_dataset.py:20
↓ 1 callersFunctiondata_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/vatex_dataset.py:14
↓ 1 callersFunctiondata_prepare
(batch_dict, **kwargs)
src/evaluation/mmeb_v2/data/datasets/didemo_dataset.py:14
↓ 1 callersFunctiondata_prepare
(batch_dict, **kwargs)
src/evaluation/mmeb_v2/data/datasets/msrvtt_dataset.py:19
↓ 1 callersFunctiondata_prepare
(batch_dict, **kwargs)
src/evaluation/mmeb_v2/data/datasets/ssv2_dataset.py:11
↓ 1 callersFunctiondata_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/momentseeker_dataset.py:17
↓ 1 callersFunctiondata_prepare
(batch_dict, **kwargs)
src/evaluation/mmeb_v2/data/datasets/vidore_dataset.py:19
↓ 1 callersFunctiondata_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/image_i2i_vg_dataset.py:9
↓ 1 callersFunctiondata_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/activitynetqa_dataset.py:15
↓ 1 callersFunctiondata_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/videomme_dataset.py:15
↓ 1 callersFunctiondata_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/moment_retrieval_datasets.py:15
↓ 1 callersFunctiondata_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/egoschema_dataset.py:14
↓ 1 callersFunctiondata_prepare
(batch_dict, **kwargs)
src/evaluation/mmeb_v2/data/datasets/msvd_dataset.py:14
↓ 1 callersFunctiondata_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/image_t2i_eval.py:8
↓ 1 callersFunctiondata_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/mvbench_dataset.py:39
↓ 1 callersFunctiondata_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/image_cls_dataset.py:9
↓ 1 callersFunctiondata_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/videommmu_dataset.py:15
↓ 1 callersFunctiondata_prepare
(batch_dict, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/image_i2t_eval.py:9
↓ 1 callersFunctiondata_prepare
(batch_dict, **kwargs)
src/evaluation/mmeb_v2/data/datasets/visrag_dataset.py:22
↓ 1 callersFunctiondownload_dataset
Download specified subset and split of a single dataset
src/evaluation/mmeb_v2/constant.py:129
↓ 1 callersFunctiondownload_url
(input_path)
src/evaluation/mmeb_v2/utils/vision_utils/video_transforms.py:38
↓ 1 callersFunctiondownload_url
(input_path)
src/evaluation/mmeb_v2/utils/vision_utils/vision_utils.py:62
↓ 1 callersFunctionexport_dataset_for_hf
Export NextQA dataset in a format loadable by datasets.load_dataset Args: output_dir: Save directory dataset_name: Datas
src/evaluation/mmeb_v2/data/datasets/nextqa_dataset.py:120
↓ 1 callersFunctionexport_msrvtt_dataset_for_hf
Export MSRVTT text-to-video retrieval dataset in a format loadable by datasets.load_dataset Args: output_dir: Output directory
src/evaluation/mmeb_v2/data/datasets/msrvtt_dataset.py:83
↓ 1 callersFunctionexport_videocls_dataset_for_hf
Export video classification dataset in a format loadable by datasets.load_dataset Args: output_dir: Save directory datas
src/evaluation/mmeb_v2/data/datasets/video_classification_datasets.py:92
↓ 1 callersFunctionexport_vidore_dataset_for_hf
Export ViDoRe text-to-document image retrieval dataset for HuggingFace datasets.load_dataset Args: output_dir: Output directory
src/evaluation/mmeb_v2/data/datasets/vidore_dataset.py:138
↓ 1 callersMethodf1_at_k
Compute F1-score@K. F1@K = 2 * (Precision@K * Recall@K) / (Precision@K + Recall@K)
src/evaluation/mmeb_v2/utils/eval_utils/metrics.py:84
↓ 1 callersMethodformat_mm_instruction
( self, query_text: Optional[Union[str, tuple]] = None, query_image: Optional[Union[Li
src/models/qwen3_vl_reranker.py:321
↓ 1 callersMethodformat_model_input
( self, text: Optional[Union[List[str], str]] = None, image: Optional[Union[List[Unio
src/models/qwen3_vl_embedding.py:220
↓ 1 callersMethodforward
(self, inputs: Dict[str, Any])
src/models/qwen3_vl_embedding.py:193
↓ 1 callersMethodforward
Forward pass for contrastive learning / evaluation.
src/evaluation/mmeb_v2/models.py:86
↓ 1 callersMethodget_binary_linear
(self, model, token_yes: int, token_no: int)
src/models/qwen3_vl_reranker.py:120
↓ 1 callersMethodget_params
(self, clip)
src/evaluation/mmeb_v2/utils/vision_utils/video_transforms.py:433
↓ 1 callersFunctionget_total_frames
Use ffprobe to get total frame count.
src/evaluation/mmeb_v2/utils/vision_utils/vision_utils.py:317
↓ 1 callersFunctionget_transforms_image
(name="center", image_size=(256, 256))
src/evaluation/mmeb_v2/utils/vision_utils/video_transforms.py:87
↓ 1 callersFunctionget_transforms_image
(name="center", image_size=(256, 256))
src/evaluation/mmeb_v2/utils/vision_utils/vision_utils.py:111
↓ 1 callersFunctionget_transforms_video
(name="center", image_size=(256, 256))
src/evaluation/mmeb_v2/utils/vision_utils/video_transforms.py:61
↓ 1 callersFunctionget_transforms_video
(name="center", image_size=(256, 256))
src/evaluation/mmeb_v2/utils/vision_utils/vision_utils.py:85
↓ 1 callersFunctionhflip
Args: clip (torch.tensor): Video clip to be normalized. Size is (T, C, H, W) Returns: flipped clip (torch.tensor): Size is (T
src/evaluation/mmeb_v2/utils/vision_utils/video_transforms.py:388
↓ 1 callersMethodhit_at_k
Compute Hit@K (or Hit Rate@K). Returns 1.0 if at least one true label is found in the top K predictions, 0.0 otherwise.
src/evaluation/mmeb_v2/utils/eval_utils/metrics.py:72
↓ 1 callersFunctionis_image_path
(path: str)
src/models/qwen3_vl_embedding.py:129
↓ 1 callersFunctionis_image_path
(path: str)
src/models/qwen3_vl_reranker.py:28
↓ 1 callersFunctionis_url
(url)
src/evaluation/mmeb_v2/utils/vision_utils/video_transforms.py:25
↓ 1 callersFunctionis_url
(url)
src/evaluation/mmeb_v2/utils/vision_utils/vision_utils.py:49
↓ 1 callersFunctionis_video_input
(video)
src/models/qwen3_vl_embedding.py:143
↓ 1 callersFunctionis_video_input
(video)
src/models/qwen3_vl_reranker.py:43
↓ 1 callersFunctionload_hf_dataset_multiple_subset
Load and concatenate multiple subsets from a Hugging Face dataset (e.g. MVBench)
src/evaluation/mmeb_v2/utils/dataset_utils.py:78
↓ 1 callersFunctionload_msrvtt_dataset
(model_args, data_args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/msrvtt_dataset.py:64
↓ 1 callersFunctionload_nextqa_dataset
(model_args, data_args, *args, **kwargs)
src/evaluation/mmeb_v2/data/datasets/nextqa_dataset.py:99
next →1–100 of 211, ranked by callers