Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/OpenDCAI/DataFlow-MM
/ types & classes
Types & classes
216 in github.com/OpenDCAI/DataFlow-MM
⨍
Functions
991
◇
Types & classes
216
↓ 72 callers
Class
FileStorage
Storage for file system.
dataflow/utils/storage.py:70
↓ 27 callers
Class
PromptedVQAGenerator
PromptedVQAGenerator reads conversation history with optional image/video inputs to generate answers. Supports both multimodal mode (with ima
dataflow/operators/core_vision/generate/prompted_vqa_generator.py:17
↓ 26 callers
Class
APIVLMServing_openai
Client for interacting with a Vision-Language Model (VLM) via OpenAI's API. Provides methods for single-image chat, batch image processing,
dataflow/serving/api_vlm_serving_openai.py:18
↓ 22 callers
Class
LocalModelVLMServing_vllm
A class for generating text using vllm, with model from huggingface or local directory
dataflow/serving/local_model_vlm_serving.py:10
↓ 16 callers
Class
FunctionalRefiner
[Refine] 通用 Python 逻辑精炼器。 用于:分句、正则解析、字符串拼接等不涉及模型调用的数据加工。
dataflow/operators/core_text/refine/functional_refiner.py:9
↓ 8 callers
Class
NamedPlaceholderPromptTemplate
通用多占位符 Prompt 模板类。 模板示例: template = ( "Descriptions:\n" "{descriptions}\n\n" "Collect all detail
dataflow/prompts/prompt_template.py:3
↓ 6 callers
Class
DiyVideoPrompt
The prompt for custom code operations.
dataflow/prompts/video.py:86
↓ 5 callers
Class
Cardinal
CARDINAL类
dataflow/operators/core_audio/refine/cn_tn.py:748
↓ 5 callers
Class
LayerNorm
Subclass torch's LayerNorm to handle fp16.
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:157
↓ 5 callers
Class
LazyLoader
dataflow/utils/registry.py:210
↓ 5 callers
Class
PromptTemplatedQAGenerator
PromptTemplatedQAGenerator: 1) 从 DataFrame 读取若干字段(由 input_keys 指定) 2) 使用 prompt_template.build_prompt(...) 生成纯文本 prompt 3) 将该 prompt
dataflow/operators/core_text/generate/prompt_templated_qa_generator.py:20
↓ 5 callers
Class
VideoCaptionGeneratorPrompt
The prompt for the video quality evaluator.
dataflow/prompts/video.py:8
↓ 5 callers
Class
VideoCaptionToQAGenerator
Generate QA conversations from video captions via a prompt template. This operator rewrites the first user message in each conversation to a
dataflow/operators/core_vision/generate/video_qa_generator.py:16
↓ 5 callers
Class
VideoClipFilter
DataFlow operator: consume video path/info/scene columns and produce per-row clip lists. Output column is configurable (default: 'video_clips
dataflow/operators/core_vision/filter/video_clip_filter.py:314
↓ 5 callers
Class
VideoClipGenerator
DataFlow operator: - 从 storage 的 dataframe 中取 `video_clips_key` 列(list 的结构) - 展平并仅切割 filtered == False 的片段 - 将成功结果 DataFrame 写入 `csv_
dataflow/operators/core_vision/generate/video_clip_generator.py:245
↓ 5 callers
Class
VideoInfoFilter
DataFlow operator: scan dataframe for video files, probe basic info, and write the processed dataframe back to storage.
dataflow/operators/core_vision/filter/video_info_filter.py:348
↓ 5 callers
Class
VideoSceneFilter
DataFlow operator: detect scenes for each video path from the input dataframe, and write the processed dataframe (adds 'video_scene' column)
dataflow/operators/core_vision/filter/video_scene_filter.py:515
↓ 4 callers
Class
ChineseNumberUnit
中文数字/数位字符 每个字符除繁简体外还有一个额外的大写字符 e.g. '陆' 和 '陸'
dataflow/operators/core_audio/refine/cn_tn.py:404
↓ 4 callers
Class
ImageIO
dataflow/io/core_io/image_gen.py:10
↓ 4 callers
Class
VideoToCaptionGenerator
Generate captions from videos by prompting a VLM service. This operator rewrites the first user message in each conversation with a template-
dataflow/operators/core_vision/generate/video_caption_generator.py:16
↓ 4 callers
Class
VisualGroundingRefiner
[Refine] 视觉一致性精炼器。 输入:文本列表 (sentences/answers) + 图片。 行为:对列表中每一项进行视觉验证 (Yes/No),去除幻觉内容。
dataflow/operators/core_vision/refine/visual_grounding_refiner.py:19
↓ 3 callers
Class
BatchVQAGenerator
[Generate] 批量视觉问答生成器。 输入:问题列表 (Questions) + 图片。 输出:答案列表 (New Text Content)。
dataflow/operators/core_vision/generate/batch_vqa_generator.py:19
↓ 3 callers
Class
ExistingBBoxDataGenConfig
dataflow/operators/core_vision/generate/image_bbox_generator.py:157
↓ 3 callers
Class
FixPromptedVQAGenerator
FixPromptedVQAGenerator generate answers for questions based on provided context. The context can be image/video.
dataflow/operators/core_vision/generate/fix_prompted_vqa_generator.py:19
↓ 3 callers
Class
GeneralTextAnswerEvaluator
Evaluate text-based answers across multiple question types. This evaluator supports multiple question types with appropriate scoring metrics:
dataflow/operators/core_vision/eval/general_text_answer_evaluator.py:17
↓ 3 callers
Class
PromptTemplatedVQAGenerator
PromptTemplatedVQAGenerator: 1) 从 DataFrame 读取若干字段(由 input_keys 指定) 2) 使用 prompt_template.build_prompt(...) 生成纯文本 prompt 3) 将该 prompt
dataflow/operators/core_vision/generate/prompt_templated_vqa_generator.py:20
↓ 3 callers
Class
ScoreFilter
通用分数过滤算子:根据指定列的分数值进行过滤
dataflow/operators/core_vision/filter/score_filter.py:9
↓ 3 callers
Class
Segment
dataflow/operators/core_audio/eval/audio_ctc_forced_alignment_transcription_quality_evaluator.py:448
↓ 3 callers
Class
VLMBBoxGenerator
[Generate] 使用通用 VLM Serving 生成 BBox 数据。 输入:Image + Keywords List 输出:BBox Map
dataflow/operators/core_vision/generate/vlm_bbox_generator.py:46
↓ 3 callers
Class
VideoCOTQAGeneratorPrompt
The prompt for the video Chain-of-Thought QA generator.
dataflow/prompts/video.py:57
↓ 3 callers
Class
VideoInfo
Container for a single video's probed metadata.
dataflow/operators/core_vision/filter/video_info_filter.py:39
↓ 3 callers
Class
VisualDependencyRefiner
[Refine] 视觉依赖性校验器。 对 MCQ 列表进行“旋转 + 双盲测试 (Visual vs Text-Only)”: 筛选出 必须依赖视觉信息 (High Visual Acc) 且 不能仅凭常识 (Low Text Acc) 的问题。
dataflow/operators/core_vision/refine/visual_dependency_refiner.py:66
↓ 3 callers
Class
VisualReasoningGenerator
[Generate] 调用 VLM 生成推理链。 支持 Fallback:如果 input_existing_chains_key 中已有数据,则直接使用,不进行生成。
dataflow/operators/core_vision/generate/visual_reasoning_generator.py:20
↓ 3 callers
Class
WikiQARefiner
文本格式规范化 + WikiQA 格式解析算子。
dataflow/operators/core_vision/refine/wiki_qa_refiner.py:81
↓ 2 callers
Class
APIImageGenServing
dataflow/serving/api_image_gen_serving.py:19
↓ 2 callers
Class
Aligner
dataflow/operators/core_audio/eval/audio_ctc_forced_alignment_transcription_quality_evaluator.py:355
↓ 2 callers
Class
Bottleneck
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:10
↓ 2 callers
Class
CTCForcedAlignmentSampleEvaluator
CTCForcedAlignmentSampleEvaluator is a class that performs CTC forced alignment on audio data.
dataflow/operators/core_audio/eval/audio_ctc_forced_alignment_transcription_quality_evaluator.py:73
↓ 2 callers
Class
ClipSample
dataflow/operators/core_vision/eval/video_aesthetic_evaluator.py:150
↓ 2 callers
Class
ClipSample
Sample representing a single clip to be processed.
dataflow/operators/core_vision/eval/video_ocr_evaluator.py:70
↓ 2 callers
Class
ClipSample
dataflow/operators/core_vision/eval/video_luminance_evaluator.py:72
↓ 2 callers
Class
Digit
DIGIT类
dataflow/operators/core_audio/refine/cn_tn.py:763
↓ 2 callers
Class
DummyStorage
dataflow/utils/storage.py:25
↓ 2 callers
Class
ImageBboxGenerator
Caption Generator is a class that generates captions for given images.
dataflow/operators/core_vision/generate/image_bbox_generator.py:164
↓ 2 callers
Class
ImageCaprlPrompt
Prompt definitions for CapRL/VisualOnlyMCQ pipeline.
dataflow/prompts/image.py:172
↓ 2 callers
Class
ImageDeduplicateFilter
dataflow/operators/core_vision/filter/image_deduplication_filter.py:15
↓ 2 callers
Class
ImageScaleCaptionPrompt
dataflow/prompts/image.py:131
↓ 2 callers
Class
LocalImageGenServing
dataflow/serving/local_image_gen_serving.py:12
↓ 2 callers
Class
LocalModelVLMServing_sglang
A class for multimodal generation using sglang Engine, 支持从 HuggingFace 或本地目录加载模型。
dataflow/serving/local_model_vlm_serving.py:220
↓ 2 callers
Class
MCTSTreeRefiner
[Refine] 解析 MCTS 树结构,提取推理链。
dataflow/operators/core_text/refine/mcts_tree_refiner.py:67
↓ 2 callers
Class
PromptedAQAGenerator
PromptedVQA is a class that generates answers for questions based on provided context.
dataflow/operators/core_audio/generate/prompted_aqa_generator.py:15
↓ 2 callers
Class
PromptedImageEditGenerator
dataflow/operators/core_vision/generate/prompted_image_edit_generator.py:14
↓ 2 callers
Class
PromptedImageGenerator
dataflow/operators/core_vision/generate/prompted_image_generator.py:13
↓ 2 callers
Class
Registry
The registry that provides name -> object mapping, to support third-party users' custom modules. To create a registry (e.g. a backbone r
dataflow/utils/registry.py:36
↓ 2 callers
Class
SceneSegment
A single processed scene segment.
dataflow/operators/core_vision/filter/video_scene_filter.py:95
↓ 2 callers
Class
SileroVADGenerator
dataflow/operators/core_audio/generate/audio_silero_voice_activity_detection_timestamps_generator.py:29
↓ 2 callers
Class
SileroVADModel
封装了一个独立的 Silero VAD 模型实例。 负责加载模型、读取音频,并执行VAD算法。
dataflow/operators/core_audio/generate/audio_silero_voice_activity_detection_timestamps_generator.py:352
↓ 2 callers
Class
TelePhone
TELEPHONE类
dataflow/operators/core_audio/refine/cn_tn.py:779
↓ 2 callers
Class
TextNorm
dataflow/operators/core_audio/refine/cn_tn.py:1058
↓ 2 callers
Class
Transformer
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:195
↓ 2 callers
Class
VideoAestheticFilter
DataFlow operator: compute aesthetic scores and filter clips based on threshold. This operator combines VideoAestheticEvaluator's scorin
dataflow/operators/core_vision/filter/video_aesthetic_filter.py:90
↓ 2 callers
Class
VideoFrameFilter
DataFlow operator: extract frames for each clip from the upstream dataframe. Consumes `video`, `video_info`, `video_clips`; produces `video_f
dataflow/operators/core_vision/filter/video_frame_filter.py:305
↓ 2 callers
Class
VideoLuminanceFilter
DataFlow operator: compute luminance statistics and filter clips based on thresholds. This operator combines VideoLuminanceEvaluator's a
dataflow/operators/core_vision/filter/video_luminance_filter.py:100
↓ 2 callers
Class
VideoMergedCaptionGenerator
DataFlow operator: generate merged caption structures from multiple clips. Input: DataFrame with individual clip captions Output: Up
dataflow/operators/core_vision/generate/video_merged_caption_generator.py:126
↓ 2 callers
Class
VideoOCRFilter
DataFlow operator: compute OCR scores and filter clips based on thresholds. This operator combines VideoOCREvaluator's analysis function
dataflow/operators/core_vision/filter/video_ocr_filter.py:100
↓ 2 callers
Class
_ClipJob
dataflow/operators/core_vision/filter/video_clip_filter.py:67
↓ 1 callers
Class
AestheticScorer
CLIP image encoder + MLP head.
dataflow/operators/core_vision/eval/video_aesthetic_evaluator.py:97
↓ 1 callers
Class
AttentionPool2d
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:58
↓ 1 callers
Class
Backend
dataflow/operators/core_vision/filter/video_info_filter.py:32
↓ 1 callers
Class
BatchWrapper
通用的批处理 Wrapper。 在静态检查/IDE 里,BatchWrapper.run 的签名和 operator.run 完全一致。 运行时,会把 operator.run 的 __doc__ 和 __signature__ 也拷过来, 这样 help(bw.
dataflow/wrapper/batch_wrapper.py:20
↓ 1 callers
Class
CLIP
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:243
↓ 1 callers
Class
CLIPScoreFilter
Evaluate CLIP scores between images and text, adding scores to dataframe. Computes the cosine similarity between CLIP embeddings of imag
dataflow/operators/core_vision/filter/clipscore_filter.py:16
↓ 1 callers
Class
CaptionGeneratorPrompt
The prompt for the AutoPromptGenerator.
dataflow/prompts/image.py:4
↓ 1 callers
Class
ChineseNumberDigit
中文数字字符
dataflow/operators/core_audio/refine/cn_tn.py:440
↓ 1 callers
Class
ClipEvalPipeline
使用 CLIPEvaluator 对 image + caption 进行图文对齐打分。
dataflow/statics/pipelines/gpu_pipelines/image_eval_clip.py:9
↓ 1 callers
Class
ClipFrameDataset
Dataset that loads up to `load_num` frames per clip. Missing/short frame sets are padded by repeating the last frame.
dataflow/operators/core_vision/eval/video_aesthetic_evaluator.py:157
↓ 1 callers
Class
ClipFrameDataset
Dataset that loads up to `load_num` frames per clip for OCR processing.
dataflow/operators/core_vision/eval/video_ocr_evaluator.py:81
↓ 1 callers
Class
ClipFrameDataset
Dataset that loads up to `load_num` frames per clip. Missing/short frame sets are padded by repeating the last frame; If no frame is foun
dataflow/operators/core_vision/eval/video_luminance_evaluator.py:79
↓ 1 callers
Class
ComplexityFilterPipeline
dataflow/statics/pipelines/gpu_pipelines/image_filter_complexity.py:10
↓ 1 callers
Class
ContextVQAPipeline
一行命令即可完成图片批量 ContextVQA Caption 生成。
dataflow/statics/pipelines/gpu_pipelines/context_vqa.py:8
↓ 1 callers
Class
ContextVQAPipeline
一行命令即可完成图片批量 ContextVQA Caption 生成。
dataflow/statics/pipelines/api_pipelines/image_contextvqa.py:12
↓ 1 callers
Class
DataSelectionPipeline
test/test_data_selection.py:39
↓ 1 callers
Class
Date
DATE类
dataflow/operators/core_audio/refine/cn_tn.py:831
↓ 1 callers
Class
FailRateFilter
Filter operator that removes successful responses and keeps only failed ones. Uses a rollout model to generate responses and a verifier
dataflow/operators/core_vision/filter/failrate_filter.py:12
↓ 1 callers
Class
Fraction
FRACTION类
dataflow/operators/core_audio/refine/cn_tn.py:813
↓ 1 callers
Class
ImageAestheticFilter
dataflow/operators/core_vision/filter/image_aesthetic_filter.py:10
↓ 1 callers
Class
ImageAestheticFilterPipeline
dataflow/statics/pipelines/cpu_pipelines/image_filter_aesthetic.py:10
↓ 1 callers
Class
ImageCLIPEvaluator
dataflow/operators/core_vision/eval/image_clip_evaluator.py:21
↓ 1 callers
Class
ImageCaptionPipeline
一行命令即可完成图片批量 Caption 生成。
dataflow/statics/pipelines/api_pipelines/image_caption.py:12
↓ 1 callers
Class
ImageCaptioningPipeline
一行命令即可完成图片批量 Caption 生成。
dataflow/statics/pipelines/gpu_pipelines/image2caption.py:10
↓ 1 callers
Class
ImageCatFilter
dataflow/operators/core_vision/filter/image_cat_filter.py:16
↓ 1 callers
Class
ImageCatFilterPipeline
dataflow/statics/pipelines/gpu_pipelines/image_filter_cat.py:11
↓ 1 callers
Class
ImageClipFilter
dataflow/operators/core_vision/filter/image_clip_filter.py:11
↓ 1 callers
Class
ImageClipFilterPipeline
dataflow/statics/pipelines/gpu_pipelines/image_filter_clip.py:10
↓ 1 callers
Class
ImageComplexityFilter
dataflow/operators/core_vision/filter/image_complexity_filter.py:10
↓ 1 callers
Class
ImageConsistencyFilter
dataflow/operators/core_vision/filter/image_consistency_filter.py:10
↓ 1 callers
Class
ImageConsistencyFilterPipeline
dataflow/statics/pipelines/gpu_pipelines/image_filter_consistency.py:10
↓ 1 callers
Class
ImageDeduplicateFilterPipeline
dataflow/statics/pipelines/gpu_pipelines/image_filter_deduplicate.py:10
↓ 1 callers
Class
ImageDiversityFilter
dataflow/operators/core_vision/filter/image_diversity_filter.py:65
↓ 1 callers
Class
ImageDiversityFilterPipeline
dataflow/statics/pipelines/cpu_pipelines/image_filter_diversity.py:11
next →
1–100 of 216, ranked by callers