MCPcopy Create free account

hub / github.com/FeiElysia/Tempo / types & classes

Types & classes488 in github.com/FeiElysia/Tempo

↓ 42 callersClassBleu
Compute BLEU score, using SacreBLEU.
lmms_eval/tasks/megabench/metrics/scoring/sacrebleu_bleu.py:6
↓ 42 callersClassServerConfig
Configuration for judge models
lmms_eval/llm_judge/protocol.py:10
↓ 27 callersClassGenerationResult
Typed wrapper returned by ``generate_until`` implementations. Models that wish to report per-sample token counts should return a list of ``Ge
lmms_eval/api/instance.py:29
↓ 22 callersClassRequest
Standard request format for judge evaluation
lmms_eval/llm_judge/protocol.py:34
↓ 22 callersClassTokenCounts
Per-request token usage counters. Fields are ``None`` when the backend cannot report them (e.g. cached responses, or backends that only expos
lmms_eval/api/instance.py:6
↓ 17 callersClassChatMessages
lmms_eval/protocol.py:45
↓ 17 callersClassConversation
A class that keeps all conversation history.
tempo/conversation.py:27
↓ 13 callersClassKeywordsStoppingCriteria
tempo/mm_datautils.py:34
↓ 10 callersClassTaskManager
TaskManager indexes all tasks from the default `lmms_eval/tasks/` and an optional directory if provided.
lmms_eval/tasks/__init__.py:19
↓ 8 callersClassMMBench_Evaluator
lmms_eval/tasks/mmbench/mmbench_evals.py:12
↓ 8 callersClassTextNorm
lmms_eval/tasks/librispeech/cn_tn.py:1039
↓ 7 callersClassBasicTextNormalizer
lmms_eval/tasks/gigaspeech/whisper_normalizer/basic.py:42
↓ 7 callersClassEnglishTextNormalizer
lmms_eval/tasks/gigaspeech/whisper_normalizer/english.py:444
↓ 6 callersClassInstance
lmms_eval/api/instance.py:70
↓ 5 callersClassCardinal
CARDINAL类
lmms_eval/tasks/librispeech/cn_tn.py:734
↓ 5 callersClassEvalAIAnswerProcessor
Processes an answer similar to Eval AI copied from https://github.com/facebookresearch/mmf/blob/c46b3b3391275b4181567db80943473a8
lmms_eval/tasks/_task_utils/vqa_eval_metric.py:4
↓ 5 callersClassEvalRunResult
Response for get_run_result tool.
lmms_eval/mcp/schemas.py:62
↓ 5 callersClassResponse
Standard response format from judge evaluation
lmms_eval/llm_judge/protocol.py:58
↓ 4 callersClassChineseNumberUnit
中文数字/数位字符 每个字符除繁简体外还有一个额外的大写字符 e.g. '陆' 和 '陸'
lmms_eval/tasks/librispeech/cn_tn.py:418
↓ 4 callersClassTEDS
Tree Edit Distance basead Similarity
lmms_eval/tasks/ocrbench_v2/TEDS_metric.py:70
↓ 3 callersClassCogMapEvaluator
Comprehensive cognitive map evaluator. This class provides a complete evaluation workflow for cognitive mapping tasks, including answer accur
lmms_eval/tasks/spatialtreebench/metrics/mindcube_cogmap/src/evaluation/cogmap/cogmap_evaluator.py:26
↓ 3 callersClassEvalRunSubmitted
Response when an evaluation run is submitted.
lmms_eval/mcp/schemas.py:41
↓ 3 callersClassFraction
FRACTION类
lmms_eval/tasks/librispeech/cn_tn.py:795
↓ 3 callersClassJobScheduler
Thread-safe job scheduler for managing evaluation jobs. The scheduler maintains a queue of jobs and processes them sequentially using a
lmms_eval/entrypoints/job_scheduler.py:30
↓ 3 callersClassMathVerifyFn
lmms_eval/tasks/_task_utils/math_verify_utils.py:101
↓ 3 callersClassMockEditRequest
lmms_eval/models/simple/qwen_image_edit.py:324
↓ 3 callersClassMockUnderstandRequest
lmms_eval/models/simple/qwen_image_edit.py:376
↓ 3 callersClassModelManifest
Declarative model registration payload for model loading. A single manifest can expose a chat implementation, a simple implementation, or bot
lmms_eval/models/registry_v2.py:12
↓ 3 callersClassOlympiadBenchEvaluator
lmms_eval/tasks/olympiadbench_mimo/olympiadbench_evals.py:23
↓ 3 callersClassQwenImageEdit
Qwen-Image-Edit 20B Model (Unified: Understanding + Editing + Visual CoT) https://huggingface.co/Qwen/Qwen-Image-Edit Modes: 1. Unde
lmms_eval/models/simple/qwen_image_edit.py:32
↓ 3 callersClassTaskConfig
lmms_eval/api/task.py:103
↓ 2 callersClassAdaptiveConcurrencyDecision
lmms_eval/models/model_utils/concurrency_control.py:38
↓ 2 callersClassChatMessage
lmms_eval/protocol.py:40
↓ 2 callersClassConfigurableGroup
lmms_eval/api/group.py:76
↓ 2 callersClassDigit
DIGIT类
lmms_eval/tasks/librispeech/cn_tn.py:750
↓ 2 callersClassEvaluationTokenizer
lmms_eval/tasks/covost2/utils.py:110
↓ 2 callersClassEvaluator
lmms_eval/tasks/capability/utils.py:171
↓ 2 callersClassEvaluator
lmms_eval/tasks/multidocvqa/utils.py:64
↓ 2 callersClassGroupConfig
lmms_eval/api/group.py:24
↓ 2 callersClassLanceVideoBlobResolver
lmms_eval/tasks/_task_utils/lance_video_resolver.py:11
↓ 2 callersClassLexicalAnalyzer
lmms_eval/tasks/mmsearch/retrieve_content/tokenization/tokenizers.py:37
↓ 2 callersClassMCPClient
lmms_eval/mcp/client.py:10
↓ 2 callersClassMathVerseEvaluator
lmms_eval/tasks/mathverse/mathverse_evals.py:12
↓ 2 callersClassMathVistaEvaluator
lmms_eval/tasks/mathvista/mathvista_evals.py:161
↓ 2 callersClassOlympiadBenchEvaluator
lmms_eval/tasks/olympiadbench/olympiadbench_evals.py:21
↓ 2 callersClassOpenAIBackend
Unified OpenAI-compatible backend for VIEScore. Works with: - OpenAI API (GPT-4o, GPT-4V, etc.) - vLLM servers with OpenAI-c
lmms_eval/tasks/gedit_bench/viescore/openai_backend.py:47
↓ 2 callersClassOutputExample
lmms_eval/tasks/ifeval/utils.py:17
↓ 2 callersClassResponseParseType
Parse the response.
lmms_eval/tasks/megabench/metrics/response_parse_type.py:13
↓ 2 callersClassServerArgs
Arguments for launching the evaluation server.
lmms_eval/entrypoints/server_args.py:5
↓ 2 callersClassTableTree
lmms_eval/tasks/ocrbench_v2/TEDS_metric.py:31
↓ 2 callersClassTelePhone
TELEPHONE类
lmms_eval/tasks/librispeech/cn_tn.py:766
↓ 2 callersClassVIEScore
lmms_eval/tasks/gedit_bench/viescore/__init__.py:8
↓ 1 callersClassAggMetricConfig
lmms_eval/api/group.py:8
↓ 1 callersClassAsciiArtVLMJudger
A GPT-4o judge for assessing if two ASCII art images depict the same thing.
lmms_eval/tasks/megabench/metrics/scoring/ascii_art_vlm_judge.py:10
↓ 1 callersClassAzureEndpointJudgeClient
Azure OpenAI compatible endpoint client backed by Azure CLI bearer tokens.
lmms_eval/tasks/unig2u/phyx/utils.py:68
↓ 1 callersClassAzureEndpointJudgeClient
Azure OpenAI compatible endpoint client backed by Azure CLI bearer tokens.
lmms_eval/tasks/unig2u/babyvision/utils.py:72
↓ 1 callersClassAzureEndpointJudgeClient
Azure OpenAI compatible endpoint client backed by Azure CLI bearer tokens.
lmms_eval/tasks/unig2u/geometry3k/utils.py:69
↓ 1 callersClassAzureEndpointJudgeClient
Azure OpenAI compatible endpoint client backed by Azure CLI bearer tokens.
lmms_eval/tasks/unig2u/auxsolidmath/utils.py:70
↓ 1 callersClassAzureJudgeClient
Azure TRAPI client for LLM Judge.
lmms_eval/tasks/unig2u/phyx/utils.py:27
↓ 1 callersClassAzureJudgeClient
Azure TRAPI client for LLM Judge.
lmms_eval/tasks/unig2u/babyvision/utils.py:31
↓ 1 callersClassAzureJudgeClient
Azure TRAPI client for LLM Judge.
lmms_eval/tasks/unig2u/geometry3k/utils.py:28
↓ 1 callersClassAzureJudgeClient
Azure TRAPI client for LLM Judge.
lmms_eval/tasks/unig2u/auxsolidmath/utils.py:29
↓ 1 callersClassBasicEvaluator
Basic task evaluator for answer accuracy only. This evaluator focuses only on extracting answers and calculating accuracy, without any cognit
lmms_eval/tasks/spatialtreebench/metrics/mindcube_cogmap/src/evaluation/evaluator.py:20
↓ 1 callersClassBasicTextNormalizer
lmms_eval/tasks/librispeech/whisper_normalizer/basic.py:42
↓ 1 callersClassCacheHook
lmms_eval/api/model.py:175
↓ 1 callersClassChatCompletionSampler
Sample from OpenAI's chat completion API
lmms_eval/tasks/gpqa/openai/utils.py:93
↓ 1 callersClassChatCompletionSampler
Sample from OpenAI's chat completion API
lmms_eval/tasks/aime/utils.py:135
↓ 1 callersClassChatCompletionSampler
Sample from OpenAI's chat completion API
lmms_eval/tasks/openai_math/utils.py:132
↓ 1 callersClassChineseNumberDigit
中文数字字符
lmms_eval/tasks/librispeech/cn_tn.py:448
↓ 1 callersClassCodeTester
lmms_eval/tasks/megabench/metrics/scoring/program_judge.py:29
↓ 1 callersClassConfig
lmms_eval/tasks/mmsearch/retrieve_content/retriever.py:11
↓ 1 callersClassContent_Retriever
lmms_eval/tasks/mmsearch/retrieve_content/retriever.py:18
↓ 1 callersClassCropCoordinateTransformer
lmms_eval/models/model_utils/thyme/sandbox.py:190
↓ 1 callersClassCustomConfig
lmms_eval/tasks/ocrbench_v2/TEDS_metric.py:50
↓ 1 callersClassDDGSQueryRun
lmms_eval/tasks/mmsearch/utils/utils.py:98
↓ 1 callersClassDataset
lmms_eval/models/simple/cambrians_vsc_streaming.py:87
↓ 1 callersClassDataset
lmms_eval/models/simple/cambrians_vsc.py:115
↓ 1 callersClassDataset
lmms_eval/models/simple/cambrians_vsr.py:213
↓ 1 callersClassDataset
lmms_eval/models/simple/cambrians.py:259
↓ 1 callersClassDate
DATE类
lmms_eval/tasks/librispeech/cn_tn.py:813
↓ 1 callersClassDiscoveryCache
lmms_eval/tui/discovery.py:137
↓ 1 callersClassDomain
lmms_eval/tasks/megabench/metrics/scoring/symbolic_planning.py:113
↓ 1 callersClassEnglishNumberNormalizer
Convert any spelled-out numbers into arabic numbers, while handling: - remove any commas - keep the suffixes such as: `1960s`, `274t
lmms_eval/tasks/gigaspeech/whisper_normalizer/english.py:12
↓ 1 callersClassEnglishNumberNormalizer
Convert any spelled-out numbers into arabic numbers, while handling: - remove any commas - keep the suffixes such as: `1960s`, `274t
lmms_eval/tasks/librispeech/whisper_normalizer/english.py:12
↓ 1 callersClassEnglishSpellingNormalizer
Applies British-American spelling mappings as listed in [1]. [1] https://www.tysto.com/uk-us-spelling-list.html
lmms_eval/tasks/gigaspeech/whisper_normalizer/english.py:429
↓ 1 callersClassEnglishSpellingNormalizer
Applies British-American spelling mappings as listed in [1]. [1] https://www.tysto.com/uk-us-spelling-list.html
lmms_eval/tasks/librispeech/whisper_normalizer/english.py:429
↓ 1 callersClassEnglishTextNormalizer
lmms_eval/tasks/librispeech/whisper_normalizer/english.py:444
↓ 1 callersClassEvalRunStatus
Response for get_run_status tool.
lmms_eval/mcp/schemas.py:50
↓ 1 callersClassEvalStartResponse
lmms_eval/tui/server.py:302
↓ 1 callersClassEvaluateRequest
Request model for evaluation endpoint.
lmms_eval/entrypoints/protocol.py:24
↓ 1 callersClassEvaluationTokenizer
lmms_eval/tasks/asr_wer_utils.py:27
↓ 1 callersClassEvaluationTracker
Keeps track and saves relevant information of the evaluation process. Compiles the data from trackers and writes it to files, which can be pu
lmms_eval/loggers/evaluation_tracker.py:100
↓ 1 callersClassExample
An example loaded from vibe-eval, stored as jsonl in the repo.
lmms_eval/tasks/vibe_eval/utils.py:75
↓ 1 callersClassExportYamlResponse
lmms_eval/tui/server.py:339
↓ 1 callersClassFilterEnsemble
FilterEnsemble creates a pipeline applying multiple filters. Its intended usage is to stack multiple post-processing steps in order. `tas
lmms_eval/api/filter.py:34
↓ 1 callersClassGPT4oJudge
lmms_eval/tasks/videoevalpro/utils.py:46
↓ 1 callersClassGeneralConfigTracker
Tracker for the evaluation parameters. Attributes: model_source (str): Source of the model (e.g. Hugging Face, GGUF, etc.) m
lmms_eval/loggers/evaluation_tracker.py:31
↓ 1 callersClassHRBenchEval
lmms_eval/tasks/hrbench/hrbench_evals.py:10
↓ 1 callersClassHealthResponse
Health check response.
lmms_eval/entrypoints/protocol.py:74
↓ 1 callersClassIdentityMap
tempo/multimodal_projector/builder.py:4
next →1–100 of 488, ranked by callers