MCPcopy Create free account

hub / github.com/OpenDCAI/DataFlow-MM / functions

Functions991 in github.com/OpenDCAI/DataFlow-MM

Method__contains__
(self, name)
dataflow/utils/registry.py:147
Method__getitem__
(self, idx: int)
dataflow/operators/core_vision/eval/video_aesthetic_evaluator.py:170
Method__getitem__
(self, idx: int)
dataflow/operators/core_vision/eval/video_ocr_evaluator.py:92
Method__getitem__
(self, idx: int)
dataflow/operators/core_vision/eval/video_luminance_evaluator.py:92
Method__init__
(self)
test/test_silero_vad_generator.py:6
Method__init__
(self)
test/test_text_to_image_evaluation.py:7
Method__init__
(self)
test/test_video_caption.py:6
Method__init__
(self)
test/test_promptedvqa.py:7
Method__init__
(self)
test/test_promptedvqa_sglang.py:8
Method__init__
(self, model_path)
test/test_data_selection.py:11
Method__init__
(self, model_path)
test/test_data_selection.py:26
Method__init__
(self)
test/test_data_selection.py:40
Method__init__
Initialize the long video cotqa pipeline with API models. Args: backend: Video backend for info extraction (open
test/test_long_video_cotqa_generator.py:156
Method__init__
(self, df: pd.DataFrame)
test/test_vision_seg_refiner.py:7
Method__init__
Initialize the VideoFilteredClipGenerator operator. Args: backend: Video backend for info extraction (opencv, to
test/test_video_filter.py:38
Method__init__
(self)
test/test_video_cotqa_generator.py:8
Method__init__
Args: use_video_in_qa: 是否在生成 QA 时输入视频。 True: 同时使用 caption 和视频生成问题 False:
test/test_promptedvideoqa.py:7
Method__init__
(self)
test/test_video_caption_api.py:11
Method__init__
( self, cache_path:str=None, file_name_prefix:str=None, cache_type: Literal[
dataflow/utils/storage.py:26
Method__init__
( self, first_entry_file_name: str, cache_path:str="./cache", file_name_prefi
dataflow/utils/storage.py:74
Method__init__
db_config: { 'host': 'localhost', 'port': 9000, 'user': 'default', 'password': '',
dataflow/utils/storage.py:318
Method__init__
初始化 LazyLoader 模块。 :param name: 模块名称 :param import_structure: 定义类名到文件路径的映射字典
dataflow/utils/registry.py:212
Method__init__
(self, max_chains_per_sample: int = 10000, seed: int = 42)
dataflow/operators/core_text/refine/mcts_tree_refiner.py:71
Method__init__
(self, func: Callable[..., Any])
dataflow/operators/core_text/refine/functional_refiner.py:14
Method__init__
(self, serving: LLMServingABC, system_prompt: str = "You are a helpful ass
dataflow/operators/core_text/generate/prompted_qa_generator.py:23
Method__init__
( self, serving: LLMServingABC, prompt_template: NamedPlaceholderPromptTemplate,
dataflow/operators/core_text/generate/prompt_templated_qa_generator.py:28
Method__init__
(self, language: str = "en", remove_puncs: bool = False, **kwargs, )
dataflow/operators/core_audio/refine/audio_text_normalizer.py:21
Method__init__
(self, simplified, traditional)
dataflow/operators/core_audio/refine/cn_tn.py:392
Method__init__
(self, power, simplified, traditional, big_s, big_t)
dataflow/operators/core_audio/refine/cn_tn.py:411
Method__init__
(self, value, simplified, traditional, big_s, big_t, alt_s=None, alt_t=None)
dataflow/operators/core_audio/refine/cn_tn.py:445
Method__init__
(self, simplified, traditional, symbol, expression=None)
dataflow/operators/core_audio/refine/cn_tn.py:466
Method__init__
(self, positive, negative, point)
dataflow/operators/core_audio/refine/cn_tn.py:492
Method__init__
(self, cardinal=None, chntext=None)
dataflow/operators/core_audio/refine/cn_tn.py:753
Method__init__
(self, digit=None, chntext=None)
dataflow/operators/core_audio/refine/cn_tn.py:768
Method__init__
(self, telephone=None, raw_chntext=None, chntext=None)
dataflow/operators/core_audio/refine/cn_tn.py:784
Method__init__
(self, fraction=None, chntext=None)
dataflow/operators/core_audio/refine/cn_tn.py:818
Method__init__
(self, money=None, chntext=None)
dataflow/operators/core_audio/refine/cn_tn.py:894
Method__init__
(self, percentage=None, chntext=None)
dataflow/operators/core_audio/refine/cn_tn.py:917
Method__init__
(self, to_banjiao:bool = False, to_upper:bool = False, to_lower:bool = False,
dataflow/operators/core_audio/refine/cn_tn.py:1059
Method__init__
( self, model_path: str = "MahmoudAshraf/mms-300m-1130-forced-aligner", device: Union
dataflow/operators/core_audio/eval/audio_ctc_forced_alignment_transcription_quality_evaluator.py:77
Method__init__
(self, model_path: str = "MahmoudAshraf/mms-300m-1130-forced-aligner", device: str = "cuda")
dataflow/operators/core_audio/eval/audio_ctc_forced_alignment_transcription_quality_evaluator.py:356
Method__init__
( self, dst_folder: str, timestamp_unit: Literal["frame", "second"] = "second", # 手动
dataflow/operators/core_audio/generaterow/audio_timestamp_chunk_row_generator.py:29
Method__init__
( self, model_path: str = "MahmoudAshraf/mms-300m-1130-forced-aligner", device: Unio
dataflow/operators/core_audio/filter/audio_ctc_forced_alignment_transcription_quality_filter.py:13
Method__init__
(self, vlm_serving: VLMServingABC, system_prompt: str = "You are a helpful assistant.")
dataflow/operators/core_audio/generate/prompted_aqa_generator.py:19
Method__init__
(self, repo_or_dir: str = "snakers4/silero-vad", source: str = "github", device: Uni
dataflow/operators/core_audio/generate/audio_silero_voice_activity_detection_timestamps_generator.py:30
Method__init__
( self, image_list_key: str = "image", video_list_key: str = "video",
dataflow/operators/conversations/format/conversation_to_message.py:14
Method__init__
(self, serving: LLMServingABC, prompt_template: str, system_prompt: str = "You are a helpful assistant.")
dataflow/operators/core_vision/refine/visual_grounding_refiner.py:25
Method__init__
( self, seg_model_path: str = "your yolo11l-seg.pt path", conf: float = 0.25,
dataflow/operators/core_vision/refine/vision_seg_cutout_refiner.py:15
Method__init__
( self, serving: LLMServingABC, instruction_template: str, rotate_num: int =
dataflow/operators/core_vision/refine/visual_dependency_refiner.py:72
Method__init__
(self)
dataflow/operators/core_vision/refine/wiki_qa_refiner.py:86
Method__init__
( self, model_name: str = "Salesforce/blip-vqa-base", device: str = None, loca
dataflow/operators/core_vision/eval/image_vqascore_evaluator.py:14
Method__init__
( self, model_name: str = "openai/clip-vit-base-patch32", device: str = None )
dataflow/operators/core_vision/eval/image_clip_evaluator.py:22
Method__init__
(self, clip_model: str, device: str)
dataflow/operators/core_vision/eval/video_aesthetic_evaluator.py:99
Method__init__
(self, samples: List[ClipSample], preprocess, load_num: int = 3)
dataflow/operators/core_vision/eval/video_aesthetic_evaluator.py:162
Method__init__
( self, figure_root: str = "extract_frames", # where frames were exported by your extractor
dataflow/operators/core_vision/eval/video_aesthetic_evaluator.py:456
Method__init__
(self, samples: List[ClipSample], load_num: int = 3)
dataflow/operators/core_vision/eval/video_ocr_evaluator.py:85
Method__init__
Initialize OCR analysis operator Args: figure_root: Directory where frames were extracted input_vide
dataflow/operators/core_vision/eval/video_ocr_evaluator.py:504
Method__init__
Initialize the evaluator. Args: use_stemmer: Whether to use stemmer in ROUGE score calculation
dataflow/operators/core_vision/eval/general_text_answer_evaluator.py:28
Method__init__
(self, samples: List[ClipSample], load_num: int = 3)
dataflow/operators/core_vision/eval/video_luminance_evaluator.py:85
Method__init__
( self, figure_root: str = "extract_frames", # where frames were exported by your extractor
dataflow/operators/core_vision/eval/video_luminance_evaluator.py:400
Method__init__
( self, model_name: str = "BeichenZhang/LongCLIP-L-336px", device: str = None, )
dataflow/operators/core_vision/eval/image_longclip_evaluator.py:22
Method__init__
(self, llm_serving: LLMServingABC, prompt_geenrator: PromptGeneratorABC, vision_info_processor)
dataflow/operators/core_vision/eval/image/image_evaluator.py:15
Method__init__
(self, bpe_path: str = default_bpe())
dataflow/operators/core_vision/eval/image_text/model/simple_tokenizer.py:63
Method__init__
(self, inplanes, planes, stride=1)
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:13
Method__init__
(self, spacial_dim: int, embed_dim: int, num_heads: int, output_dim: int = None)
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:59
Method__init__
(self, layers, output_dim, heads, input_resolution=224, width=64)
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:102
Method__init__
(self, d_model: int, n_head: int, attn_mask: torch.Tensor = None)
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:172
Method__init__
(self, width: int, layers: int, heads: int, attn_mask: torch.Tensor = None)
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:196
Method__init__
(self, input_resolution: int, patch_size: int, width: int, layers: int, heads: int, output_dim: int)
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:207
Method__init__
Initialize the VisionDependentFilter operator. Args: rollout: Model for generating responses (will run without v
dataflow/operators/core_vision/filter/vision_dependent_filter.py:20
Method__init__
Initialize VideoLuminanceFilter operator. Args: figure_root: Directory where frames were extracted i
dataflow/operators/core_vision/filter/video_luminance_filter.py:109
Method__init__
( self, model_name: str = "facebook/bart-large-mnli", threshold: float = 0.35,
dataflow/operators/core_vision/filter/image_consistency_filter.py:11
Method__init__
( self, model_name: str = "facebook/bart-large-mnli", threshold: float = 0.4,
dataflow/operators/core_vision/filter/image_complexity_filter.py:25
Method__init__
( self, model_name: str = "openai/clip-vit-base-patch32", device: str = None )
dataflow/operators/core_vision/filter/image_clip_filter.py:12
Method__init__
初始化 Args: min_score: 保留样本的最小运动分数 max_score: 保留样本的最大运动分数 sampling_fps: 光流计算的采样帧率(帧/秒)
dataflow/operators/core_vision/filter/video_motion_score_filter.py:44
Method__init__
Initialize the CLIPScoreEval operator. Args: model_name: CLIP model name from HuggingFace batch_size
dataflow/operators/core_vision/filter/clipscore_filter.py:25
Method__init__
初始化分数过滤算子 Args: min_score: 最小分数阈值(包含),低于此分数的行将被标记为 False max_score: 最大分数阈值(包含),高于此分数的行将被标记为 False
dataflow/operators/core_vision/filter/score_filter.py:14
Method__init__
( self, blur_thresh: float = 150.0, brightness_range: tuple[float, float] = (30, 230),
dataflow/operators/core_vision/filter/image_aesthetic_filter.py:11
Method__init__
( self, model_name: str = "facebook/bart-large-mnli", threshold: float = 0.5,
dataflow/operators/core_vision/filter/image_sensitive_filter.py:23
Method__init__
Initialize the DataTailorEval operator. Args: model_name: Qwen2-VL model name from HuggingFace clust
dataflow/operators/core_vision/filter/datatailor_filter.py:30
Method__init__
Initialize the KNNSimilarityFilter operator. Args: model_name: CLIP model name from HuggingFace k_ne
dataflow/operators/core_vision/filter/knn_similarity_filter.py:26
Method__init__
(self, similarity_thresh: float = 0.8, max_corpus: int = 10000)
dataflow/operators/core_vision/filter/image_diversity_filter.py:15
Method__init__
(self, hash_size: int = 8, distance_thresh: int = 5, max_imgs: int = 10000)
dataflow/operators/core_vision/filter/image_diversity_filter.py:38
Method__init__
(self, text_thresh: float = 0.8, hash_size: int = 8, img_dist_thresh: int = 5)
dataflow/operators/core_vision/filter/image_diversity_filter.py:66
Method__init__
Initialize the FailRateFilter operator. Args: rollout: Vision-language model for generating responses
dataflow/operators/core_vision/filter/failrate_filter.py:20
Method__init__
( self, backend: str = Backend.OPENCV.value, disable_parallel: bool = False, n
dataflow/operators/core_vision/filter/video_info_filter.py:354
Method__init__
初始化 Args: min_width: 最小水平分辨率(宽度) max_width: 最大水平分辨率(宽度) min_height: 最小垂直分辨率(高度)
dataflow/operators/core_vision/filter/video_resolution_filter.py:21
Method__init__
初始化数据集过滤算子 Args: 各种过滤条件参数,与filter_clips函数对应 seed: 随机种子,用于保证可重复性 strict_mode: 是否严格模式,True
dataflow/operators/core_vision/filter/video_score_filter.py:166
Method__init__
Initialize VideoAestheticFilter operator. Args: figure_root: Directory where frames were extracted i
dataflow/operators/core_vision/filter/video_aesthetic_filter.py:99
Method__init__
( self, input_video_key: str = "video", video_info_key: str = "video_info", vi
dataflow/operators/core_vision/filter/video_clip_filter.py:320
Method__init__
( self, model_name: str = "facebook/bart-large-mnli", complexity_thresh: float = 0.4,
dataflow/operators/core_vision/filter/image_cat_filter.py:30
Method__init__
( self, frame_skip: int = 0, start_remove_sec: float = 0.0, end_remove_sec: fl
dataflow/operators/core_vision/filter/video_scene_filter.py:521
Method__init__
(self, min_triples: int = 2, ocr_overlap_threshold: float = 0.2)
dataflow/operators/core_vision/filter/cat_filter.py:38
Method__init__
Initialize VideoOCRFilter operator. Args: figure_root: Directory where frames were extracted input_v
dataflow/operators/core_vision/filter/video_ocr_filter.py:109
Method__init__
( self, input_video_key: str = "video", video_info_key: str = "video_info", vi
dataflow/operators/core_vision/filter/video_frame_filter.py:311
Method__init__
(self, text: str, start: int, end: int)
dataflow/operators/core_vision/filter/rule_base_filter.py:17
Method__init__
Initialize the Multi-Modal Curator Filter.
dataflow/operators/core_vision/filter/rule_base_filter.py:69
Method__init__
Initialize the DeduplicateFilter operator. Args: model_name: CLIP model name from HuggingFace thresh
dataflow/operators/core_vision/filter/image_deduplication_filter.py:16
Method__init__
( self, video_save_dir: str = "./cache/video_clips", drop_invalid_timestamps: bool = F
dataflow/operators/core_vision/generate/video_clip_generator.py:253
Method__init__
Initialize VideoMergedCaptionGenerator operator. Args: caption_key: Column name for caption text id_
dataflow/operators/core_vision/generate/video_merged_caption_generator.py:134
← previousnext →501–600 of 991, ranked by callers