MCPcopy Create free account

hub / github.com/OpenDCAI/DataFlow-MM / functions

Functions991 in github.com/OpenDCAI/DataFlow-MM

↓ 1 callersFunction_cos_sim_unit
(a: torch.Tensor, b: torch.Tensor)
dataflow/operators/core_vision/eval/image_longclip_evaluator.py:13
↓ 1 callersMethod_count_capabilities
(self, caption: str)
dataflow/operators/core_vision/filter/image_cat_filter.py:122
↓ 1 callersFunction_default_min_hashes
(self, data_dict)
dataflow/utils/storage.py:290
↓ 1 callersMethod_derive_output_path
(self, img_path: str)
dataflow/operators/core_vision/refine/vision_seg_cutout_refiner.py:37
↓ 1 callersFunction_detect_raw_scenes
Run PySceneDetect to get raw scene boundaries (in seconds). Returns: (scene_pairs_in_seconds, fps) Notes: - Uses Content
dataflow/operators/core_vision/filter/video_scene_filter.py:119
↓ 1 callersFunction_discover_clip_images
Discover image files for a given clip: <figure_root>/<stem>/<clip_id>/img/*.jpg
dataflow/operators/core_vision/eval/video_aesthetic_evaluator.py:248
↓ 1 callersFunction_discover_clip_images
Discover image files for a given clip: <figure_root>/<stem>/<clip_id>/img/*.jpg Returns all found images.
dataflow/operators/core_vision/eval/video_ocr_evaluator.py:134
↓ 1 callersFunction_discover_clip_images
Discover image files for a given clip: <figure_root>/<stem>/<clip_id>/img/*.jpg
dataflow/operators/core_vision/eval/video_luminance_evaluator.py:167
↓ 1 callersFunction_download
(url: str, root: str)
dataflow/operators/core_vision/eval/image_text/model/longclip.py:178
↓ 1 callersMethod_encode_vae_image
(self, image: torch.Tensor, generator: torch.Generator)
dataflow/serving/utils/diffusers/flux_kontext_pipeline.py:594
↓ 1 callersMethod_extract_and_save_image
save generated image from API response
dataflow/serving/api_vlm_serving_openai.py:340
↓ 1 callersMethod_extract_answer
Extract content between <answer> and </answer> tags.
dataflow/statics/pipelines/gpu_pipelines/video_cotqa_pipeline.py:57
↓ 1 callersMethod_extract_answer
Extract content between <answer> and </answer> tags.
dataflow/statics/pipelines/api_pipelines/video_cotqa_api_pipeline.py:57
↓ 1 callersMethod_extract_embeddings
Extract CLIP embeddings for a list of images. Args: images: List of images in various formats
dataflow/operators/core_vision/filter/knn_similarity_filter.py:63
↓ 1 callersMethod_extract_embeddings
Extract CLIP embeddings for a list of images. Args: images: List of images in various formats
dataflow/operators/core_vision/filter/image_deduplication_filter.py:73
↓ 1 callersFunction_extract_frames_for_job
Top-level picklable worker that extracts frames for a single clip within a video. Returns a dict containing per-clip results.
dataflow/operators/core_vision/filter/video_frame_filter.py:130
↓ 1 callersMethod_extract_multimodal_features
Extract multi-modal token embeddings and sample features from Qwen2-VL. Returns: Tuple of (token_features_list,
dataflow/operators/core_vision/filter/datatailor_filter.py:96
↓ 1 callersMethod_extract_think
Extract content between <think> and </think> tags.
dataflow/statics/pipelines/gpu_pipelines/video_cotqa_pipeline.py:48
↓ 1 callersMethod_extract_think
Extract content between <think> and </think> tags.
dataflow/statics/pipelines/api_pipelines/video_cotqa_api_pipeline.py:48
↓ 1 callersFunction_extract_video_name
Extract original video name from clip ID. Example: "trailer_0" -> "trailer", "video_name_5" -> "video_name"
dataflow/operators/core_vision/generate/video_merged_caption_generator.py:24
↓ 1 callersMethod_filter_sample
Filter a single multi-modal sample. Returns True if keep, False if filter out.
dataflow/operators/core_vision/filter/rule_base_filter.py:356
↓ 1 callersMethod_find_duplicates
Find duplicate images based on embedding similarity. Args: embeddings: Image embeddings of shape (n_images, embe
dataflow/operators/core_vision/filter/image_deduplication_filter.py:122
↓ 1 callersFunction_first_path
(cell: Any)
dataflow/operators/core_vision/filter/video_frame_filter.py:74
↓ 1 callersFunction_flatten_video_clips
把你给的 video_clips(list,每元素含 {success, error, clips:[...] }) 展平成 DataFrame(每条 clip 一行)。
dataflow/operators/core_vision/generate/video_clip_generator.py:131
↓ 1 callersFunction_fps_from_info
(cell: Any)
dataflow/operators/core_vision/filter/video_frame_filter.py:81
↓ 1 callersMethod_gen_prompt
(self, bbox_count: int)
dataflow/operators/core_vision/generate/image_bbox_generator.py:237
↓ 1 callersMethod_generate_on_pipe
Helper to generate images for a batch of prompts on a single pipeline.
dataflow/serving/local_image_gen_serving.py:104
↓ 1 callersMethod_generate_visualization
(self, image_path: str, bboxes: List[List[float]],vispath,counter)
dataflow/operators/core_vision/generate/image_bbox_generator.py:231
↓ 1 callersMethod_get_clip_prompt_embeds
( self, prompt: Union[str, List[str]], num_images_per_prompt: int = 1, device:
dataflow/serving/utils/diffusers/flux_kontext_pipeline.py:310
↓ 1 callersFunction_get_hwf
(cell: Any)
dataflow/operators/core_vision/filter/video_clip_filter.py:231
↓ 1 callersFunction_get_path
(cell: Any)
dataflow/operators/core_vision/filter/video_clip_filter.py:224
↓ 1 callersFunction_get_scenes
Normalize scenes list: - Prefer dict format from `video_scene['scenes']` - If cell is malformed or empty, return []
dataflow/operators/core_vision/filter/video_clip_filter.py:251
↓ 1 callersMethod_get_sys_prompt
(self)
dataflow/operators/core_vision/generate/visual_reasoning_generator.py:32
↓ 1 callersMethod_get_t5_prompt_embeds
( self, prompt: Union[str, List[str]] = None, num_images_per_prompt: int = 1,
dataflow/serving/utils/diffusers/flux_kontext_pipeline.py:260
↓ 1 callersMethod_get_video_resolution
获取视频分辨率 Args: video_path: 视频文件路径 Returns: tuple: (width, height),如果失败返回 (-1, -1
dataflow/operators/core_vision/filter/video_resolution_filter.py:85
↓ 1 callersMethod_load_nsfw_detector
Load NSFW detection model.
dataflow/operators/core_vision/filter/rule_base_filter.py:152
↓ 1 callersMethod_longest_common_prefix_len
计算两个字符串的最长公共前缀长度
dataflow/utils/registry.py:292
↓ 1 callersFunction_make_clips_for_job
Build per-row clip entries from scene boundaries and video_info. Returns {"success": bool, "error": Optional[str], "clips": [clip dicts]}
dataflow/operators/core_vision/filter/video_clip_filter.py:80
↓ 1 callersMethod_normalize_bboxes
(self, bboxes: List[List[float]], img_width: int, img_height: int,row=None)
dataflow/operators/core_vision/generate/image_bbox_generator.py:222
↓ 1 callersMethod_parallel_process
(self, audio_paths: List[str], texts_normalized: List[str], ctc_params: Dict[str, Any])
dataflow/operators/core_audio/eval/audio_ctc_forced_alignment_transcription_quality_evaluator.py:301
↓ 1 callersMethod_parallel_process
直接使用 self.pool 分发任务,不再创建Pool。
dataflow/operators/core_audio/generate/audio_silero_voice_activity_detection_timestamps_generator.py:301
↓ 1 callersMethod_parse_multimodal_tokens
解析文本中的多模态token,并返回它们的计数和去除token后的文本。
dataflow/operators/conversations/format/conversation_to_message.py:31
↓ 1 callersMethod_parse_multimodal_tokens
解析文本中的多模态token,并返回它们的计数和去除token后的文本。
dataflow/io/qwen_audio/qwen_audio_2.py:127
↓ 1 callersMethod_parse_multimodal_tokens
解析文本中的多模态token,并返回它们的计数和去除token后的文本。
dataflow/io/whisper/whisper.py:113
↓ 1 callersMethod_parse_multimodal_tokens
解析文本中的多模态token,并返回它们的计数和去除token后的文本。
dataflow/io/unifiedreward_qwen/unifiedreward.py:128
↓ 1 callersMethod_parse_multimodal_tokens
解析文本中的多模态token,并返回它们的计数和去除token后的文本。
dataflow/io/qwen_vl/qwen_vl_2_5.py:170
↓ 1 callersFunction_parse_target_size
Accepts "640*360" or (640, 360) or None. Returns (w, h) or None.
dataflow/operators/core_vision/filter/video_frame_filter.py:57
↓ 1 callersMethod_perform_selection
V_i = (1/3) * V_i^Inf + (1/3) * (V_i^Uni + V_i^Rep)
dataflow/operators/core_vision/filter/datatailor_filter.py:351
↓ 1 callersMethod_prepare_qwen_messages
Prepare messages format for Qwen2-VL.
dataflow/operators/core_vision/filter/datatailor_filter.py:72
↓ 1 callersMethod_prepare_text_patterns
Prepare regex patterns for text filtering.
dataflow/operators/core_vision/filter/rule_base_filter.py:161
↓ 1 callersMethod_print_results_summary
Print summary of final results.
dataflow/statics/pipelines/gpu_pipelines/video_cotqa_pipeline.py:104
↓ 1 callersMethod_print_results_summary
Print summary of final results.
dataflow/statics/pipelines/api_pipelines/video_cotqa_api_pipeline.py:104
↓ 1 callersFunction_probe_single
Probe a single video path with the chosen backend. This is exception-safe and returns a structured VideoInfo. Notes: - If 'path'
dataflow/operators/core_vision/filter/video_info_filter.py:212
↓ 1 callersFunction_probe_with_av
Probe basic video info using PyAV. Returns: (num_frames, height, width, fps, duration_sec) Notes: PyAV can provide dura
dataflow/operators/core_vision/filter/video_info_filter.py:134
↓ 1 callersFunction_probe_with_opencv
Probe basic video info using OpenCV. Returns: (num_frames, height, width, fps) Raises: ValueError if the video cannot be
dataflow/operators/core_vision/filter/video_info_filter.py:70
↓ 1 callersFunction_probe_with_torchvision
Probe basic video info using TorchVision's read_video. Returns: (num_frames, height, width, fps) Notes: Assumes your lo
dataflow/operators/core_vision/filter/video_info_filter.py:99
↓ 1 callersMethod_process_image
(self, img_path: str)
dataflow/operators/core_vision/refine/vision_seg_cutout_refiner.py:41
↓ 1 callersMethod_process_responses
Process CoT QA responses to extract answers and think chains.
dataflow/statics/pipelines/gpu_pipelines/video_cotqa_pipeline.py:89
↓ 1 callersMethod_process_responses
Process CoT QA responses to extract answers and think chains.
dataflow/statics/pipelines/api_pipelines/video_cotqa_api_pipeline.py:89
↓ 1 callersFunction_read_audio_base64
(b64: str, sr: Optional[int] = DEFAULT_SR)
dataflow/utils/audio.py:29
↓ 1 callersFunction_resolution
Compute pixel count safely.
dataflow/operators/core_vision/filter/video_info_filter.py:192
↓ 1 callersFunction_resolution_str
(width: Optional[int], height: Optional[int])
dataflow/operators/core_vision/filter/video_clip_filter.py:43
↓ 1 callersMethod_resolve_image_path
Resolve image path. If it's a relative path, resolve it to an absolute path relative to base_dir. If it's an absolute path, return it
dataflow/operators/core_vision/generate/prompted_image_edit_generator.py:31
↓ 1 callersFunction_sample_frames_from_video
Sample up to `load_num` frames from the whole video (evenly spaced). Used when we don't have extracted frames on disk (e.g. video_clips_key=N
dataflow/operators/core_vision/eval/video_ocr_evaluator.py:146
↓ 1 callersFunction_sample_frames_from_video_pil
Sample up to `load_num` frames from the whole video (evenly spaced) and return PIL Images. Used when we don't have extracted frames on disk (
dataflow/operators/core_vision/eval/video_aesthetic_evaluator.py:210
↓ 1 callersFunction_sample_frames_from_video_uint8
Sample up to `load_num` frames from the whole video (evenly spaced). Returns RGB uint8 tensors with shape (C,H,W). Used when we don't hav
dataflow/operators/core_vision/eval/video_luminance_evaluator.py:126
↓ 1 callersMethod_serial_process
(self, audio_paths: List[str], texts_normalized: List[str], ctc_params: Dict[str, Any])
dataflow/operators/core_audio/eval/audio_ctc_forced_alignment_transcription_quality_evaluator.py:292
↓ 1 callersMethod_serial_process
串行处理器:在一个循环中处理所有音频。
dataflow/operators/core_audio/generate/audio_silero_voice_activity_detection_timestamps_generator.py:291
↓ 1 callersMethod_set_first_user_message
Safely set the first user message's 'value' in a conversation. Expected format: a list of messages (dicts), where the first item repr
dataflow/operators/core_vision/generate/video_caption_generator.py:54
↓ 1 callersMethod_set_first_user_message
(conversation: object, value: str)
dataflow/operators/core_vision/generate/personalized_qa_generator.py:103
↓ 1 callersMethod_set_first_user_message
Safely set the first user message's 'value' in a conversation. Expected format: a list of messages (dicts), where the first item repr
dataflow/operators/core_vision/generate/video_qa_generator.py:62
↓ 1 callersMethod_set_first_user_message
Safely set the first user message's 'value' in a conversation.
dataflow/operators/core_vision/generate/video_cotqa_generator.py:72
↓ 1 callersMethod_similarity
(self, a, b)
dataflow/utils/registry.py:301
↓ 1 callersFunction_split_video_by_fixed_interval
Split video by fixed interval, similar to step1_split_videos.py logic. Args: video_duration: Total video duration in seconds
dataflow/operators/core_vision/filter/video_scene_filter.py:259
↓ 1 callersMethod_tokenize_safe
(self, text: str)
dataflow/operators/core_vision/eval/image_longclip_evaluator.py:75
↓ 1 callersFunction_trim_and_split_scenes
Apply head/tail trimming and split long scenes into chunks within [min, max]. Returns a list of (start_sec, end_sec).
dataflow/operators/core_vision/filter/video_scene_filter.py:155
↓ 1 callersFunction_trim_and_split_scenes_overlap
Apply head/tail trimming and split long scenes with overlap strategy. Similar to clip_caption.py logic: - If scene duration > max_seconds
dataflow/operators/core_vision/filter/video_scene_filter.py:206
↓ 1 callersMethod_unpack_latents
(latents, height, width, vae_scale_factor)
dataflow/serving/utils/diffusers/flux_kontext_pipeline.py:579
↓ 1 callersMethod_validate_dataframe
(self, df: pd.DataFrame)
dataflow/operators/core_vision/refine/wiki_qa_refiner.py:110
↓ 1 callersMethodanalyze_images_with_gpt
Analyze multiple images in a single request with labels. :param image_paths: List of image file paths. :param image_labels:
dataflow/serving/api_vlm_serving_openai.py:380
↓ 1 callersMethodattention
(self, x: torch.Tensor)
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:185
↓ 1 callersFunctionavailable_models
Returns the names of available CLIP models
dataflow/operators/core_vision/eval/image_text/model/longclip.py:174
↓ 1 callersFunctionbasic_clean
(text)
dataflow/operators/core_vision/eval/image_text/model/simple_tokenizer.py:50
↓ 1 callersMethodbpe
(self, token)
dataflow/operators/core_vision/eval/image_text/model/simple_tokenizer.py:80
↓ 1 callersMethodbuild_attention_mask
(self)
dataflow/operators/core_vision/eval/image_text/model/model_longclip.py:341
↓ 1 callersMethodbuild_prompt
(self)
dataflow/prompts/image.py:64
↓ 1 callersMethodcalculate_reward
Calculate reward based on question type and model output. Args: gt_solution: Ground truth solution (with <answer> tags)
dataflow/operators/core_vision/eval/general_text_answer_evaluator.py:102
↓ 1 callersFunctioncalculate_shift
( image_seq_len, base_seq_len: int = 256, max_seq_len: int = 4096, base_shift: float = 0.5,
dataflow/serving/utils/diffusers/flux_kontext_pipeline.py:100
↓ 1 callersMethodchat_with_one_image
Perform a chat completion using a single image and a text prompt. :param image_path: Path to the image file. :param text_pro
dataflow/serving/api_vlm_serving_openai.py:225
↓ 1 callersMethodcheck_distance
(self, image_path: str)
dataflow/operators/core_vision/filter/image_diversity_filter.py:44
↓ 1 callersMethodcheck_diversity
(self, image_path: str, text: str)
dataflow/operators/core_vision/filter/image_diversity_filter.py:100
↓ 1 callersMethodcheck_inputs
( self, prompt, prompt_2, height, width, negative_prompt=None,
dataflow/serving/utils/diffusers/flux_kontext_pipeline.py:484
↓ 1 callersMethodcheck_similarity
(self, text: str)
dataflow/operators/core_vision/filter/image_diversity_filter.py:20
↓ 1 callersFunctionchunk_list
(data, num_chunks)
dataflow/operators/core_audio/generaterow/audio_timestamp_chunk_row_generator.py:23
↓ 1 callersFunctionclean_punctuations
(s: str)
dataflow/operators/core_audio/refine/audio_text_normalizer.py:14
↓ 1 callersFunctioncli_env
()
dataflow/cli_funcs/cli_env.py:66
↓ 1 callersFunctioncli_init
(subcommand)
dataflow/cli_funcs/cli_init.py:35
↓ 1 callersMethodcombine_images_to_base64
Combine multiple images into one and return the combined image as a Base64 string. :param image_paths: List of image file paths.
dataflow/serving/api_vlm_serving_openai.py:85
↓ 1 callersMethodcompute_rouge_score
Calculate average ROUGE F-measure.
dataflow/operators/core_vision/eval/general_text_answer_evaluator.py:95
↓ 1 callersMethodcompute_similarity
(self, image_path: str, text: str)
dataflow/operators/core_vision/eval/image_clip_evaluator.py:58
← previousnext →201–300 of 991, ranked by callers