MCPcopy Create free account

hub / github.com/OpenDCAI/DataFlow-MM / types & classes

Types & classes216 in github.com/OpenDCAI/DataFlow-MM

↓ 72 callersClassFileStorage
Storage for file system.
dataflow/utils/storage.py:70
↓ 27 callersClassPromptedVQAGenerator
PromptedVQAGenerator reads conversation history with optional image/video inputs to generate answers. Supports both multimodal mode (with ima
dataflow/operators/core_vision/generate/prompted_vqa_generator.py:17
↓ 26 callersClassAPIVLMServing_openai
Client for interacting with a Vision-Language Model (VLM) via OpenAI's API. Provides methods for single-image chat, batch image processing,
dataflow/serving/api_vlm_serving_openai.py:18
↓ 22 callersClassLocalModelVLMServing_vllm
A class for generating text using vllm, with model from huggingface or local directory
dataflow/serving/local_model_vlm_serving.py:10
↓ 16 callersClassFunctionalRefiner
[Refine] 通用 Python 逻辑精炼器。 用于:分句、正则解析、字符串拼接等不涉及模型调用的数据加工。
dataflow/operators/core_text/refine/functional_refiner.py:9
↓ 8 callersClassNamedPlaceholderPromptTemplate
通用多占位符 Prompt 模板类。 模板示例: template = ( "Descriptions:\n" "{descriptions}\n\n" "Collect all detail
dataflow/prompts/prompt_template.py:3
↓ 6 callersClassDiyVideoPrompt
The prompt for custom code operations.
dataflow/prompts/video.py:86
↓ 5 callersClassCardinal
CARDINAL类
dataflow/operators/core_audio/refine/cn_tn.py:748
↓ 5 callersClassLayerNorm
Subclass torch's LayerNorm to handle fp16.
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:157
↓ 5 callersClassLazyLoader
dataflow/utils/registry.py:210
↓ 5 callersClassPromptTemplatedQAGenerator
PromptTemplatedQAGenerator: 1) 从 DataFrame 读取若干字段(由 input_keys 指定) 2) 使用 prompt_template.build_prompt(...) 生成纯文本 prompt 3) 将该 prompt
dataflow/operators/core_text/generate/prompt_templated_qa_generator.py:20
↓ 5 callersClassVideoCaptionGeneratorPrompt
The prompt for the video quality evaluator.
dataflow/prompts/video.py:8
↓ 5 callersClassVideoCaptionToQAGenerator
Generate QA conversations from video captions via a prompt template. This operator rewrites the first user message in each conversation to a
dataflow/operators/core_vision/generate/video_qa_generator.py:16
↓ 5 callersClassVideoClipFilter
DataFlow operator: consume video path/info/scene columns and produce per-row clip lists. Output column is configurable (default: 'video_clips
dataflow/operators/core_vision/filter/video_clip_filter.py:314
↓ 5 callersClassVideoClipGenerator
DataFlow operator: - 从 storage 的 dataframe 中取 `video_clips_key` 列(list 的结构) - 展平并仅切割 filtered == False 的片段 - 将成功结果 DataFrame 写入 `csv_
dataflow/operators/core_vision/generate/video_clip_generator.py:245
↓ 5 callersClassVideoInfoFilter
DataFlow operator: scan dataframe for video files, probe basic info, and write the processed dataframe back to storage.
dataflow/operators/core_vision/filter/video_info_filter.py:348
↓ 5 callersClassVideoSceneFilter
DataFlow operator: detect scenes for each video path from the input dataframe, and write the processed dataframe (adds 'video_scene' column)
dataflow/operators/core_vision/filter/video_scene_filter.py:515
↓ 4 callersClassChineseNumberUnit
中文数字/数位字符 每个字符除繁简体外还有一个额外的大写字符 e.g. '陆' 和 '陸'
dataflow/operators/core_audio/refine/cn_tn.py:404
↓ 4 callersClassImageIO
dataflow/io/core_io/image_gen.py:10
↓ 4 callersClassVideoToCaptionGenerator
Generate captions from videos by prompting a VLM service. This operator rewrites the first user message in each conversation with a template-
dataflow/operators/core_vision/generate/video_caption_generator.py:16
↓ 4 callersClassVisualGroundingRefiner
[Refine] 视觉一致性精炼器。 输入:文本列表 (sentences/answers) + 图片。 行为:对列表中每一项进行视觉验证 (Yes/No),去除幻觉内容。
dataflow/operators/core_vision/refine/visual_grounding_refiner.py:19
↓ 3 callersClassBatchVQAGenerator
[Generate] 批量视觉问答生成器。 输入:问题列表 (Questions) + 图片。 输出:答案列表 (New Text Content)。
dataflow/operators/core_vision/generate/batch_vqa_generator.py:19
↓ 3 callersClassExistingBBoxDataGenConfig
dataflow/operators/core_vision/generate/image_bbox_generator.py:157
↓ 3 callersClassFixPromptedVQAGenerator
FixPromptedVQAGenerator generate answers for questions based on provided context. The context can be image/video.
dataflow/operators/core_vision/generate/fix_prompted_vqa_generator.py:19
↓ 3 callersClassGeneralTextAnswerEvaluator
Evaluate text-based answers across multiple question types. This evaluator supports multiple question types with appropriate scoring metrics:
dataflow/operators/core_vision/eval/general_text_answer_evaluator.py:17
↓ 3 callersClassPromptTemplatedVQAGenerator
PromptTemplatedVQAGenerator: 1) 从 DataFrame 读取若干字段(由 input_keys 指定) 2) 使用 prompt_template.build_prompt(...) 生成纯文本 prompt 3) 将该 prompt
dataflow/operators/core_vision/generate/prompt_templated_vqa_generator.py:20
↓ 3 callersClassScoreFilter
通用分数过滤算子:根据指定列的分数值进行过滤
dataflow/operators/core_vision/filter/score_filter.py:9
↓ 3 callersClassSegment
dataflow/operators/core_audio/eval/audio_ctc_forced_alignment_transcription_quality_evaluator.py:448
↓ 3 callersClassVLMBBoxGenerator
[Generate] 使用通用 VLM Serving 生成 BBox 数据。 输入:Image + Keywords List 输出:BBox Map
dataflow/operators/core_vision/generate/vlm_bbox_generator.py:46
↓ 3 callersClassVideoCOTQAGeneratorPrompt
The prompt for the video Chain-of-Thought QA generator.
dataflow/prompts/video.py:57
↓ 3 callersClassVideoInfo
Container for a single video's probed metadata.
dataflow/operators/core_vision/filter/video_info_filter.py:39
↓ 3 callersClassVisualDependencyRefiner
[Refine] 视觉依赖性校验器。 对 MCQ 列表进行“旋转 + 双盲测试 (Visual vs Text-Only)”: 筛选出 必须依赖视觉信息 (High Visual Acc) 且 不能仅凭常识 (Low Text Acc) 的问题。
dataflow/operators/core_vision/refine/visual_dependency_refiner.py:66
↓ 3 callersClassVisualReasoningGenerator
[Generate] 调用 VLM 生成推理链。 支持 Fallback:如果 input_existing_chains_key 中已有数据,则直接使用,不进行生成。
dataflow/operators/core_vision/generate/visual_reasoning_generator.py:20
↓ 3 callersClassWikiQARefiner
文本格式规范化 + WikiQA 格式解析算子。
dataflow/operators/core_vision/refine/wiki_qa_refiner.py:81
↓ 2 callersClassAPIImageGenServing
dataflow/serving/api_image_gen_serving.py:19
↓ 2 callersClassAligner
dataflow/operators/core_audio/eval/audio_ctc_forced_alignment_transcription_quality_evaluator.py:355
↓ 2 callersClassBottleneck
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:10
↓ 2 callersClassCTCForcedAlignmentSampleEvaluator
CTCForcedAlignmentSampleEvaluator is a class that performs CTC forced alignment on audio data.
dataflow/operators/core_audio/eval/audio_ctc_forced_alignment_transcription_quality_evaluator.py:73
↓ 2 callersClassClipSample
dataflow/operators/core_vision/eval/video_aesthetic_evaluator.py:150
↓ 2 callersClassClipSample
Sample representing a single clip to be processed.
dataflow/operators/core_vision/eval/video_ocr_evaluator.py:70
↓ 2 callersClassClipSample
dataflow/operators/core_vision/eval/video_luminance_evaluator.py:72
↓ 2 callersClassDigit
DIGIT类
dataflow/operators/core_audio/refine/cn_tn.py:763
↓ 2 callersClassDummyStorage
dataflow/utils/storage.py:25
↓ 2 callersClassImageBboxGenerator
Caption Generator is a class that generates captions for given images.
dataflow/operators/core_vision/generate/image_bbox_generator.py:164
↓ 2 callersClassImageCaprlPrompt
Prompt definitions for CapRL/VisualOnlyMCQ pipeline.
dataflow/prompts/image.py:172
↓ 2 callersClassImageDeduplicateFilter
dataflow/operators/core_vision/filter/image_deduplication_filter.py:15
↓ 2 callersClassImageScaleCaptionPrompt
dataflow/prompts/image.py:131
↓ 2 callersClassLocalImageGenServing
dataflow/serving/local_image_gen_serving.py:12
↓ 2 callersClassLocalModelVLMServing_sglang
A class for multimodal generation using sglang Engine, 支持从 HuggingFace 或本地目录加载模型。
dataflow/serving/local_model_vlm_serving.py:220
↓ 2 callersClassMCTSTreeRefiner
[Refine] 解析 MCTS 树结构,提取推理链。
dataflow/operators/core_text/refine/mcts_tree_refiner.py:67
↓ 2 callersClassPromptedAQAGenerator
PromptedVQA is a class that generates answers for questions based on provided context.
dataflow/operators/core_audio/generate/prompted_aqa_generator.py:15
↓ 2 callersClassPromptedImageEditGenerator
dataflow/operators/core_vision/generate/prompted_image_edit_generator.py:14
↓ 2 callersClassPromptedImageGenerator
dataflow/operators/core_vision/generate/prompted_image_generator.py:13
↓ 2 callersClassRegistry
The registry that provides name -> object mapping, to support third-party users' custom modules. To create a registry (e.g. a backbone r
dataflow/utils/registry.py:36
↓ 2 callersClassSceneSegment
A single processed scene segment.
dataflow/operators/core_vision/filter/video_scene_filter.py:95
↓ 2 callersClassSileroVADGenerator
dataflow/operators/core_audio/generate/audio_silero_voice_activity_detection_timestamps_generator.py:29
↓ 2 callersClassSileroVADModel
封装了一个独立的 Silero VAD 模型实例。 负责加载模型、读取音频,并执行VAD算法。
dataflow/operators/core_audio/generate/audio_silero_voice_activity_detection_timestamps_generator.py:352
↓ 2 callersClassTelePhone
TELEPHONE类
dataflow/operators/core_audio/refine/cn_tn.py:779
↓ 2 callersClassTextNorm
dataflow/operators/core_audio/refine/cn_tn.py:1058
↓ 2 callersClassTransformer
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:195
↓ 2 callersClassVideoAestheticFilter
DataFlow operator: compute aesthetic scores and filter clips based on threshold. This operator combines VideoAestheticEvaluator's scorin
dataflow/operators/core_vision/filter/video_aesthetic_filter.py:90
↓ 2 callersClassVideoFrameFilter
DataFlow operator: extract frames for each clip from the upstream dataframe. Consumes `video`, `video_info`, `video_clips`; produces `video_f
dataflow/operators/core_vision/filter/video_frame_filter.py:305
↓ 2 callersClassVideoLuminanceFilter
DataFlow operator: compute luminance statistics and filter clips based on thresholds. This operator combines VideoLuminanceEvaluator's a
dataflow/operators/core_vision/filter/video_luminance_filter.py:100
↓ 2 callersClassVideoMergedCaptionGenerator
DataFlow operator: generate merged caption structures from multiple clips. Input: DataFrame with individual clip captions Output: Up
dataflow/operators/core_vision/generate/video_merged_caption_generator.py:126
↓ 2 callersClassVideoOCRFilter
DataFlow operator: compute OCR scores and filter clips based on thresholds. This operator combines VideoOCREvaluator's analysis function
dataflow/operators/core_vision/filter/video_ocr_filter.py:100
↓ 2 callersClass_ClipJob
dataflow/operators/core_vision/filter/video_clip_filter.py:67
↓ 1 callersClassAestheticScorer
CLIP image encoder + MLP head.
dataflow/operators/core_vision/eval/video_aesthetic_evaluator.py:97
↓ 1 callersClassAttentionPool2d
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:58
↓ 1 callersClassBackend
dataflow/operators/core_vision/filter/video_info_filter.py:32
↓ 1 callersClassBatchWrapper
通用的批处理 Wrapper。 在静态检查/IDE 里,BatchWrapper.run 的签名和 operator.run 完全一致。 运行时,会把 operator.run 的 __doc__ 和 __signature__ 也拷过来, 这样 help(bw.
dataflow/wrapper/batch_wrapper.py:20
↓ 1 callersClassCLIP
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:243
↓ 1 callersClassCLIPScoreFilter
Evaluate CLIP scores between images and text, adding scores to dataframe. Computes the cosine similarity between CLIP embeddings of imag
dataflow/operators/core_vision/filter/clipscore_filter.py:16
↓ 1 callersClassCaptionGeneratorPrompt
The prompt for the AutoPromptGenerator.
dataflow/prompts/image.py:4
↓ 1 callersClassChineseNumberDigit
中文数字字符
dataflow/operators/core_audio/refine/cn_tn.py:440
↓ 1 callersClassClipEvalPipeline
使用 CLIPEvaluator 对 image + caption 进行图文对齐打分。
dataflow/statics/pipelines/gpu_pipelines/image_eval_clip.py:9
↓ 1 callersClassClipFrameDataset
Dataset that loads up to `load_num` frames per clip. Missing/short frame sets are padded by repeating the last frame.
dataflow/operators/core_vision/eval/video_aesthetic_evaluator.py:157
↓ 1 callersClassClipFrameDataset
Dataset that loads up to `load_num` frames per clip for OCR processing.
dataflow/operators/core_vision/eval/video_ocr_evaluator.py:81
↓ 1 callersClassClipFrameDataset
Dataset that loads up to `load_num` frames per clip. Missing/short frame sets are padded by repeating the last frame; If no frame is foun
dataflow/operators/core_vision/eval/video_luminance_evaluator.py:79
↓ 1 callersClassComplexityFilterPipeline
dataflow/statics/pipelines/gpu_pipelines/image_filter_complexity.py:10
↓ 1 callersClassContextVQAPipeline
一行命令即可完成图片批量 ContextVQA Caption 生成。
dataflow/statics/pipelines/gpu_pipelines/context_vqa.py:8
↓ 1 callersClassContextVQAPipeline
一行命令即可完成图片批量 ContextVQA Caption 生成。
dataflow/statics/pipelines/api_pipelines/image_contextvqa.py:12
↓ 1 callersClassDataSelectionPipeline
test/test_data_selection.py:39
↓ 1 callersClassDate
DATE类
dataflow/operators/core_audio/refine/cn_tn.py:831
↓ 1 callersClassFailRateFilter
Filter operator that removes successful responses and keeps only failed ones. Uses a rollout model to generate responses and a verifier
dataflow/operators/core_vision/filter/failrate_filter.py:12
↓ 1 callersClassFraction
FRACTION类
dataflow/operators/core_audio/refine/cn_tn.py:813
↓ 1 callersClassImageAestheticFilter
dataflow/operators/core_vision/filter/image_aesthetic_filter.py:10
↓ 1 callersClassImageAestheticFilterPipeline
dataflow/statics/pipelines/cpu_pipelines/image_filter_aesthetic.py:10
↓ 1 callersClassImageCLIPEvaluator
dataflow/operators/core_vision/eval/image_clip_evaluator.py:21
↓ 1 callersClassImageCaptionPipeline
一行命令即可完成图片批量 Caption 生成。
dataflow/statics/pipelines/api_pipelines/image_caption.py:12
↓ 1 callersClassImageCaptioningPipeline
一行命令即可完成图片批量 Caption 生成。
dataflow/statics/pipelines/gpu_pipelines/image2caption.py:10
↓ 1 callersClassImageCatFilter
dataflow/operators/core_vision/filter/image_cat_filter.py:16
↓ 1 callersClassImageCatFilterPipeline
dataflow/statics/pipelines/gpu_pipelines/image_filter_cat.py:11
↓ 1 callersClassImageClipFilter
dataflow/operators/core_vision/filter/image_clip_filter.py:11
↓ 1 callersClassImageClipFilterPipeline
dataflow/statics/pipelines/gpu_pipelines/image_filter_clip.py:10
↓ 1 callersClassImageComplexityFilter
dataflow/operators/core_vision/filter/image_complexity_filter.py:10
↓ 1 callersClassImageConsistencyFilter
dataflow/operators/core_vision/filter/image_consistency_filter.py:10
↓ 1 callersClassImageConsistencyFilterPipeline
dataflow/statics/pipelines/gpu_pipelines/image_filter_consistency.py:10
↓ 1 callersClassImageDeduplicateFilterPipeline
dataflow/statics/pipelines/gpu_pipelines/image_filter_deduplicate.py:10
↓ 1 callersClassImageDiversityFilter
dataflow/operators/core_vision/filter/image_diversity_filter.py:65
↓ 1 callersClassImageDiversityFilterPipeline
dataflow/statics/pipelines/cpu_pipelines/image_filter_diversity.py:11
next →1–100 of 216, ranked by callers