MCPcopy Create free account

hub / github.com/FeiElysia/Tempo / functions

Functions7,449 in github.com/FeiElysia/Tempo

↓ 4 callersFunction_extract_image_bytes
(img_data: Any)
lmms_eval/tasks/uni_mmmu/utils.py:58
↓ 4 callersMethod_extract_image_from_various_formats
Extract PIL Image from various formats.
lmms_eval/models/simple/illume_plus.py:893
↓ 4 callersFunction_extract_instruction_score_and_reason
(response: str)
lmms_eval/tasks/kris_bench/utils.py:387
↓ 4 callersMethod_get_config
(self, name)
lmms_eval/tasks/__init__.py:207
↓ 4 callersFunction_get_int_env
(name: str, default: int)
lmms_eval/tasks/structeditbench/utils.py:84
↓ 4 callersFunction_has_image_choices
(doc: dict)
lmms_eval/tasks/wm_abench/utils.py:32
↓ 4 callersFunction_load_baseline_from_local
Load baseline from local JSONL file.
lmms_eval/baselines/loader.py:78
↓ 4 callersFunction_looks_like_visual_haystack
(doc: dict)
lmms_eval/tasks/mmlongbench/utils.py:33
↓ 4 callersMethod_normalize_clip_item
(self, visual: Any)
lmms_eval/models/simple/penguinvl.py:175
↓ 4 callersFunction_normalize_text
(text)
lmms_eval/tasks/tvbench/utils.py:30
↓ 4 callersFunction_normalize_text
(text)
lmms_eval/tasks/mmie/utils.py:10
↓ 4 callersFunction_recall_match
"Recall" here means: does the model mention the correct label somewhere in its output. This matches the original codebase evaluation style (s
lmms_eval/tasks/unig2u/illusionbench/arshia_utils.py:68
↓ 4 callersFunction_safe_decrypt
(ciphertext_b64: str, password: str)
lmms_eval/tasks/browsecomp/utils.py:87
↓ 4 callersFunction_safe_get
(doc, keys, default="")
lmms_eval/tasks/tvbench/utils.py:22
↓ 4 callersMethod_save_audio_to_temp
Save audio array to a temporary WAV file and return the path.
lmms_eval/models/simple/omnivinci.py:287
↓ 4 callersMethod_stage1_generate_image
(self, generation_prompt: str, doc_id: str, task: str, original_images=None)
lmms_eval/models/simple/illume_plus.py:939
↓ 4 callersFunction_stats_to_output
Convert a stats dict with acc/caa num/den to output format.
lmms_eval/tasks/sitebench/merge_results.py:376
↓ 4 callersMethod_summarize_latency
(self, values: List[float])
lmms_eval/models/simple/dummy.py:140
↓ 4 callersFunction_tokenize_str
(role, content)
lmms_eval/models/model_utils/qwen/qwen_generate_utils.py:134
↓ 4 callersFunction_tokenize_str
(role, content)
lmms_eval/models/simple/cambrian.py:79
↓ 4 callersFunction_touch_text
(path: str, content: str = "")
lmms_eval/caching/response_cache.py:131
↓ 4 callersFunction_try_parse_grid_candidate
(candidate: str)
lmms_eval/tasks/arc_agi_2/utils.py:124
↓ 4 callersMethodaggregation
:returns: {str: [metric_score] -> float} A dictionary where keys are the names of submetrics and values are functions
lmms_eval/api/task.py:610
↓ 4 callersMethodbuild_description
(self)
lmms_eval/tasks/ifeval/instructions.py:846
↓ 4 callersFunctionbuild_prompt
Build the prompt text based on question category.
lmms_eval/tasks/osi_bench/utils.py:164
↓ 4 callersFunctionbuild_query
Build the text query by combining the context, question and options. The <image_n> token is still there Return a dictionary with the query and gro
lmms_eval/tasks/emma/utils.py:59
↓ 4 callersFunctioncalculate_average_score
Weighted average across categories by sample count.
lmms_eval/tasks/ocrbench_v2/utils.py:379
↓ 4 callersFunctioncalculate_iou
(box1, box2)
lmms_eval/tasks/ocrbench_v2/IoUscore_metric.py:7
↓ 4 callersFunctioncalculate_iou
Calculate the IoU between predicted and target bounding boxes.
lmms_eval/tasks/megabench/metrics/scoring/common/metrics.py:6
↓ 4 callersFunctionchn2num
(chinese_string, numbering_type=NUMBERING_TYPES[1])
lmms_eval/tasks/librispeech/cn_tn.py:563
↓ 4 callersMethodclean
(self)
lmms_eval/api/model.py:166
↓ 4 callersFunctioncompute_accuracy
(grouped_results)
lmms_eval/tasks/lemonade/utils.py:268
↓ 4 callersFunctioncompute_f1_score
Compute the F1-score for KIE task between predicted and ground truth dictionaries. Args: preds (dict): The predicted key-value pairs.
lmms_eval/tasks/ocrbench_v2/TEDS_metric.py:383
↓ 4 callersFunctioncompute_random_expected_acc
Compute the random expected accuracy (1/num_options average). Returns: tuple of (avg_random_acc, total_counted, missing_count)
lmms_eval/tasks/sitebench/merge_results.py:69
↓ 4 callersFunctioncompute_stats_from_jsonl
Compute aggregated statistics from a samples JSONL file. Returns: dict with keys: metric_stats, category_stats, overall
lmms_eval/tasks/sitebench/merge_results.py:98
↓ 4 callersFunctionconstruct_message
( content_data, data_type, query, multimodal_processor, sample_fps=1, return_text=Fals
tempo/mm_datautils.py:251
↓ 4 callersFunctionconstruct_prompt
(doc, mc_prompt="", open_ended_prompt="", prompt_type="reasoning")
lmms_eval/tasks/mmmu/utils.py:55
↓ 4 callersFunctionconvert_time_to_frame
(time_in_seconds, fps)
lmms_eval/tasks/egoplan/utils.py:55
↓ 4 callersFunctiondict_to_html
(data)
lmms_eval/tasks/ocrbench_v2/TEDS_metric.py:199
↓ 4 callersMethoddoc_to_target
(self, doc: dict)
lmms_eval/api/task.py:1436
↓ 4 callersMethoddoc_to_text
(self, doc)
lmms_eval/api/task.py:1399
↓ 4 callersFunctiondownsample_cache_states
(cache_states: torch.Tensor, downsample_ratio: int, visual_features: torch.Tensor)
lmms_eval/models/simple/cambrians_vsr.py:64
↓ 4 callersMethodencode_image
( self, image: Union[Image.Image, str], cache: Optional[Dict[Tuple[object, ...], str]]
lmms_eval/protocol.py:179
↓ 4 callersFunctionencode_image_to_base64_with_size_limit
( image: ImageInput, *, max_size_bytes: int, image_format: str = "PNG", convert_rgb: bool
lmms_eval/models/model_utils/media_encoder.py:170
↓ 4 callersMethodevaluate
Run basic evaluation with answer accuracy only. Args: jsonl_path: Path to JSONL file with model responses output_path
lmms_eval/tasks/spatialtreebench/metrics/mindcube_cogmap/src/evaluation/evaluator.py:27
↓ 4 callersFunctionferret_aggregation
(results, category)
lmms_eval/tasks/ferret/utils.py:185
↓ 4 callersFunctionfind_word_position
(string, word)
lmms_eval/tasks/naturalbench/utils.py:122
↓ 4 callersMethodflatten
(self, input)
lmms_eval/models/simple/llava_hf.py:249
↓ 4 callersFunctionfloatify
(num: str)
lmms_eval/tasks/megabench/metrics/scoring/general_numerical_match.py:138
↓ 4 callersFunctionformat_reward
Check if the prediction string follows the expected format. Now handles both <think><answer> format and \boxed{} format.
lmms_eval/tasks/_task_utils/reasoning_utils.py:155
↓ 4 callersMethodfrom_string
(cls, s)
lmms_eval/tasks/megabench/metrics/metric_type.py:188
↓ 4 callersFunctionget_column_value
Helper function to get value from document with multiple possible column names
lmms_eval/tasks/ami/utils.py:19
↓ 4 callersMethodget_config
(self, key: str)
lmms_eval/api/task.py:1736
↓ 4 callersFunctionget_file_datetime
Given the results and sample results filenames, extracts and returns the datetime.
lmms_eval/utils.py:328
↓ 4 callersFunctionget_git_commit_hash
Gets the git commit hash of your current repo (if it exists). Source: https://github.com/EleutherAI/gpt-neox/blob/b608043be541602170bfcfb8ec9
lmms_eval/utils.py:778
↓ 4 callersMethodget_manifest
Return canonical manifest for a model id or alias.
lmms_eval/models/registry_v2.py:170
↓ 4 callersFunctionget_metric_aggregation
(name)
lmms_eval/api/registry.py:153
↓ 4 callersMethodget_metrics
(self, gt_answers, preds)
lmms_eval/tasks/multidocvqa/utils.py:70
↓ 4 callersFunctionget_rerank_incontext_example
(rerank_num)
lmms_eval/tasks/mmsearch/utils/prompt_utils.py:25
↓ 4 callersFunctionget_scores
Calculate various scores based on the given results. Args: scores (dict or list): A dictionary or list containing results where each
lmms_eval/tasks/camerabench_vqa/utils.py:9
↓ 4 callersFunctionget_scores
Calculate various scores based on the given results. Args: scores (dict or list): A dictionary or list containing results where each
lmms_eval/tasks/naturalbench/utils.py:9
↓ 4 callersMethodhas_test_docs
Whether the task has a test set
lmms_eval/api/task.py:347
↓ 4 callersMethodhas_test_docs
(self)
lmms_eval/api/task.py:1192
↓ 4 callersMethodhas_validation_docs
Whether the task has a validation set
lmms_eval/api/task.py:342
↓ 4 callersMethodhas_validation_docs
(self)
lmms_eval/api/task.py:1186
↓ 4 callersFunctionisRecord
(value: unknown)
lmms_eval/tui/web/src/LogViewer.tsx:43
↓ 4 callersFunctionis_higher_better
(metric_name)
lmms_eval/api/registry.py:162
↓ 4 callersFunctionis_non_str_iterable
(obj)
lmms_eval/api/metrics.py:460
↓ 4 callersFunctionllava_aggregation
(results, category)
lmms_eval/tasks/llava-in-the-wild/utils.py:114
↓ 4 callersFunctionllava_aggregation
(results, category)
lmms_eval/tasks/llava-in-the-wild/utils_ko.py:161
↓ 4 callersFunctionllava_aggregation
(results, category)
lmms_eval/tasks/multilingual-llava-bench-in-the-wild/utils.py:151
↓ 4 callersFunctionllava_aggregation
(results, category)
lmms_eval/tasks/llava-bench-coco/utils.py:162
↓ 4 callersFunctionnormalize_answer
Normalize answer for comparison. Args: answer: Raw answer string Returns: Normalized answer
lmms_eval/tasks/mmsearch_plus/utils.py:72
↓ 4 callersFunctionnormalize_math_notation
Normalize mathematical notation for comparison (e.g., n² -> n^2, n³ -> n^3)
lmms_eval/tasks/mmvu/utils.py:134
↓ 4 callersFunctionparse_bool
(value)
lmms_eval/models/model_utils/concurrency_control.py:47
↓ 4 callersFunctionparse_choice_img
(choice: str, img_token: str)
lmms_eval/tasks/seedbench_2_plus/utils.py:8
↓ 4 callersFunctionparse_choice_img
(choice: str, img_token: str = "<image>")
lmms_eval/tasks/seedbench_2_plus/reasoning/utils.py:7
↓ 4 callersFunctionparse_choice_img
(choice: str, img_token: str)
lmms_eval/tasks/seedbench_2/utils.py:8
↓ 4 callersFunctionparse_multi_choice_response
Parse the prediction from the generated response. Return the predicted index e.g., A, B, C, D.
lmms_eval/tasks/visualwebbench/utils.py:223
↓ 4 callersFunctionparse_pddl_attr_from_string
( s, attr_starter="(:", attr_ender=")", inner_starter="(", inner_ender=")", overlap=Fa
lmms_eval/tasks/megabench/metrics/scoring/symbolic_planning.py:43
↓ 4 callersFunctionparse_subtitle_time
(time_str)
lmms_eval/tasks/egoplan/utils.py:33
↓ 4 callersFunctionparse_time
(tstr)
lmms_eval/tasks/scivideobench/utils.py:23
↓ 4 callersFunctionpower_analysis
Calculate minimum sample size for paired t-test power analysis. For paired samples, the effective variance is: Var(X - Y) = Var(X) +
lmms_eval/api/metrics.py:877
↓ 4 callersMethodprepare_messages
Prepare messages in the format expected by the API
lmms_eval/llm_judge/base.py:33
↓ 4 callersFunctionprocess_option_for_question
(sent)
lmms_eval/tasks/vitatecs/utils.py:69
↓ 4 callersFunctionprocess_videos
(videos, image_processor, model_cfg, num_threads=-1)
lmms_eval/models/simple/cambrians.py:81
↓ 4 callersFunctionremove_not
(x)
lmms_eval/tasks/scibench/utils.py:84
↓ 4 callersFunctionremove_sp
(text)
lmms_eval/tasks/covost2/utils.py:76
↓ 4 callersMethodresample_audio
Resample audio to 16kHz and convert to mono if needed.
lmms_eval/models/simple/omnivinci.py:210
↓ 4 callersMethodset_config
Set or update the configuration for a given key.
lmms_eval/api/task.py:702
↓ 4 callersFunctionsimple_parse
Parse the prediction string to extract the answer. Args: predict_str (str): The prediction string to be parsed. Returns: str
lmms_eval/tasks/_task_utils/reasoning_utils.py:186
↓ 4 callersFunctionstr_to_iterable
Converts a string representation of an iterable to an iterable.
lmms_eval/tasks/megabench/metrics/scoring/common/conversions.py:45
↓ 4 callersFunctionstr_to_set
Converts a string representation of an iterable to a set.
lmms_eval/tasks/megabench/metrics/scoring/common/conversions.py:86
↓ 4 callersFunctionverify
(s, target_sequence)
lmms_eval/tasks/gedit_bench/viescore/utils.py:97
↓ 4 callersFunctionvqa_evaluation
(predict, answers)
lmms_eval/tasks/ocrbench_v2/vqa_metric.py:21
↓ 3 callersMethod__init__
pass a string `regex` to run `re.compile(r"regex")` on. `fallback` defines the output returned if no matches for the regex are locate
lmms_eval/filters/extraction.py:33
↓ 3 callersMethod__init__
(self, date=None, chntext=None)
lmms_eval/tasks/librispeech/cn_tn.py:818
↓ 3 callersFunction_aggregate
(results: List[Dict[str, Any]], target_type: Optional[str] = None)
lmms_eval/tasks/screenspot_pro/utils.py:139
↓ 3 callersFunction_aggregate
(results: List[Dict[str, Any]], target_type: Optional[str] = None)
lmms_eval/tasks/screenspot_v2/utils.py:108
↓ 3 callersFunction_aggregate
(records: List[Dict[str, Any]])
lmms_eval/models/model_utils/usage_metrics.py:170
← previousnext →201–300 of 7,449, ranked by callers