MCPcopy Create free account

hub / github.com/OPPO-Mente-Lab/X2I / functions

Functions612 in github.com/OPPO-Mente-Lab/X2I

↓ 1 callersMethodget_slice_image_placeholder
(self, image_size, image_idx=0, max_slice_nums=None, use_image_id=None)
minicpm/image_processing_minicpmv.py:281
↓ 1 callersMethodget_sliced_images
(self, image, max_slice_nums=None)
minicpm/image_processing_minicpmv.py:231
↓ 1 callersFunctionget_text_embeddings
(output_hidden_state)
infer/inference_internvl.py:159
↓ 1 callersFunctionget_text_embeddings
(output_hidden_state)
infer/inference_minicpm.py:116
↓ 1 callersFunctionget_text_embeddings
(output_hidden_state)
infer/inference_qwenvl.py:121
↓ 1 callersMethodget_tts_text_start_token_ids
(self)
minicpm/modeling_minicpmo.py:1310
↓ 1 callersFunctionimage2image
(outputs=outputs)
infer/inference_internvl.py:248
↓ 1 callersFunctionimage2image
(outputs=outputs)
infer/inference_minicpm.py:238
↓ 1 callersFunctionimage2image
(outputs=outputs)
infer/inference_qwenvl.py:240
↓ 1 callersFunctionimagetext2image
(outputs=outputs)
infer/inference_internvl.py:262
↓ 1 callersFunctionimagetext2image
(outputs=outputs)
infer/inference_minicpm.py:256
↓ 1 callersFunctionimagetext2image
(outputs=outputs)
infer/inference_qwenvl.py:258
↓ 1 callersFunctioninfer
(args, infer_pg, is_infer_rank, infer_rank,teacher,paths)
train/train_minicpm.py:663
↓ 1 callersFunctioninfer
(args, infer_pg, is_infer_rank, infer_rank,teacher,paths)
train/train_internvl.py:659
↓ 1 callersFunctioninfer
(args, infer_pg, is_infer_rank, infer_rank,teacher,paths)
train/train_qwenvl.py:658
↓ 1 callersMethodinit_audio_module
(self)
minicpm/modeling_minicpmo.py:214
↓ 1 callersMethodinit_resampler
(self, embed_dim, vision_dim)
minicpm/modeling_minicpmo.py:205
↓ 1 callersMethodinit_tts
load tts tokenizer and vocos 1. try load form local 2. try load from huggingface
minicpm/modeling_minicpmo.py:140
↓ 1 callersMethodinit_tts_module
(self)
minicpm/modeling_minicpmo.py:218
↓ 1 callersMethodinit_vision_module
(self)
minicpm/modeling_minicpmo.py:191
↓ 1 callersMethodinitialize_vocos
(self, ckpt_path)
minicpm/modeling_minicpmo.py:168
↓ 1 callersFunctionis_silent
(data)
minicpm/utils.py:25
↓ 1 callersFunctionis_silent
(data)
minicpm/utils copy.py:25
↓ 1 callersFunctionlecun_normal_
(tensor)
minicpm/modeling_navit_siglip.py:264
↓ 1 callersMethodllm_generate_chunk
(self, input_ids, attention_mask, tokenizer, terminators, generation_config)
minicpm/modeling_minicpmo.py:1232
↓ 1 callersFunctionload_image
(image, input_size=448, max_num=12)
utils/internvl_util.py:72
↓ 1 callersFunctionmain
(args)
lightcontrol/train_lightcontrol.py:457
↓ 1 callersFunctionmain
(args)
train/train_minicpm.py:840
↓ 1 callersFunctionmain
(args)
train/train_internvl.py:831
↓ 1 callersFunctionmain
(args)
train/train_qwenvl.py:831
↓ 1 callersMethodmerge_inputs_embeds
Merge `input_ids` and `lm_spk_emb_last_hidden_states` to `inputs_embeds`. Args: input_ids (torch.Tensor): Input token IDs.
minicpm/modeling_minicpmo.py:2740
↓ 1 callersFunctionnew_infer_pg
(rank, local_infer_world_size, local_world_size, world_size, backend="nccl")
core/pipeline/train_and_infer.py:31
↓ 1 callersFunctionnew_train_pg
(rank, local_infer_world_size, local_world_size, world_size, backend="nccl")
core/pipeline/train_and_infer.py:61
↓ 1 callersMethodnumber_to_chinese_digit_by_digit
(self, num_str)
minicpm/utils.py:93
↓ 1 callersMethodnumber_to_chinese_digit_by_digit
(self, num_str)
minicpm/utils copy.py:93
↓ 1 callersMethodnumber_to_english_digit_by_digit
(self, num_str)
minicpm/utils.py:100
↓ 1 callersMethodnumber_to_english_digit_by_digit
(self, num_str)
minicpm/utils copy.py:100
↓ 1 callersFunctionparse_args
(input_args=None)
lightcontrol/train_lightcontrol.py:47
↓ 1 callersFunctionparse_args
(input_args=None)
train/train_minicpm.py:68
↓ 1 callersFunctionparse_args
(input_args=None)
train/train_internvl.py:67
↓ 1 callersFunctionparse_args
(input_args=None)
train/train_qwenvl.py:63
↓ 1 callersMethodpixel_shuffle
(self, x, scale_factor=0.5)
model_internvl/internvl/modeling_internvl_chat.py:172
↓ 1 callersMethodprefill_audio_ids
Prefill a chunk of audio ids to the model. Used in sliding-window long audio generation. Specifically, prefill many audio ids (typically from
minicpm/modeling_minicpmo.py:2857
↓ 1 callersMethodprepare_data
(self)
utils/datamodule_lightcontrol.py:102
↓ 1 callersMethodprepare_data
(self)
utils/datamodule_qwenvl.py:101
↓ 1 callersMethodprepare_data
(self)
utils/datamodule_minicpm.py:103
↓ 1 callersMethodprepare_data
(self)
utils/datamodule_internvl.py:99
↓ 1 callersMethodpreprocess
( self, images: Union[Image.Image, List[Image.Image], List[List[Image.Image]]], do_pad
minicpm/image_processing_minicpmv.py:341
↓ 1 callersMethodput_result
(self, item, timeout=None)
core/data/dataloader.py:296
↓ 1 callersFunctionreceive_from_infer_device
(data, infer_pg, is_infer_rank, infer_rank)
core/pipeline/train_and_infer.py:107
↓ 1 callersMethodreplace_numbers_with_text
(self, text, language=None)
minicpm/utils.py:112
↓ 1 callersMethodreshape_by_patch
:param image: shape [3, H, W] :param patch_size: :return: [3, patch_size, HW/patch_size]
minicpm/image_processing_minicpmv.py:327
↓ 1 callersFunctionretrieve_timesteps
( scheduler, num_inference_steps: Optional[int] = None, device: Optional[Union[str, torch.device]]
train/train_minicpm.py:254
↓ 1 callersFunctionretrieve_timesteps
( scheduler, num_inference_steps: Optional[int] = None, device: Optional[Union[str, torch.device]]
train/train_internvl.py:251
↓ 1 callersFunctionretrieve_timesteps
( scheduler, num_inference_steps: Optional[int] = None, device: Optional[Union[str, torch.device]]
train/train_qwenvl.py:248
↓ 1 callersFunctionseed_torch
(seed=2024)
train/train_minicpm.py:830
↓ 1 callersFunctionseed_torch
(seed=2024)
train/train_internvl.py:821
↓ 1 callersFunctionseed_torch
(seed=2024)
train/train_qwenvl.py:821
↓ 1 callersFunctionsend_to_infer_device
(data, infer_pg, is_infer_rank, infer_rank)
core/pipeline/train_and_infer.py:80
↓ 1 callersFunctionsentence_end
(txt)
minicpm/utils.py:32
↓ 1 callersMethodsetup
(self, stage=None)
utils/datamodule_lightcontrol.py:120
↓ 1 callersMethodsetup
(self, stage=None)
utils/datamodule_qwenvl.py:120
↓ 1 callersMethodsetup
(self, stage=None)
utils/datamodule_minicpm.py:122
↓ 1 callersMethodsetup
(self, stage=None)
utils/datamodule_internvl.py:117
↓ 1 callersMethodslice_image
(self, image, max_slice_nums=9, scale_resolution=448, patch_size=14, never_split=False)
minicpm/image_processing_minicpmv.py:187
↓ 1 callersMethodsplit_to_patches
(self, image, grid)
minicpm/image_processing_minicpmv.py:173
↓ 1 callersMethodsubsequent_chunk_mask
Create mask for subsequent steps (size, size) with chunk size, this is for streaming encoder Args: size (int): size of ma
minicpm/modeling_minicpmo.py:240
↓ 1 callersFunctiontext2image
(outputs=outputs)
infer/inference_internvl.py:228
↓ 1 callersFunctiontext2image
(outputs=outputs)
infer/inference_minicpm.py:218
↓ 1 callersFunctiontext2image
(outputs=outputs)
infer/inference_qwenvl.py:220
↓ 1 callersMethodto_pil_image
Converts `image` to a PIL Image. Optionally rescales it and puts the channel dimension back as the last axis if needed. Args
minicpm/image_processing_minicpmv.py:297
↓ 1 callersFunctiontrain
(args, infer_pg, is_infer_rank, train_pg, group_rank, infer_rank,teacher,paths)
train/train_minicpm.py:372
↓ 1 callersFunctiontrain
(args, infer_pg, is_infer_rank, train_pg, group_rank, infer_rank,teacher,paths)
train/train_internvl.py:367
↓ 1 callersFunctiontrain
(args, infer_pg, is_infer_rank, train_pg, group_rank, infer_rank,teacher,paths)
train/train_qwenvl.py:365
↓ 1 callersFunctiontrunc_normal_tf_
Fills the input Tensor with values drawn from a truncated normal distribution. The values are effectively drawn from the normal distribution :
minicpm/modeling_navit_siglip.py:215
↓ 1 callersFunctionuniform_sample
(l, n)
infer/inference_minicpm.py:122
↓ 1 callersFunctionversion_cmp
(v1, v2, op='eq')
model_internvl/internvl/modeling_internvl_chat.py:28
↓ 1 callersFunctionvideo2image
(outputs=outputs)
infer/inference_minicpm.py:281
↓ 1 callersFunctionvideo2image
(outputs=outputs)
infer/inference_qwenvl.py:283
↓ 1 callersFunctionx2image
(outputs=outputs)
infer/inference_minicpm.py:323
↓ 1 callersFunctionx2image
(outputs=outputs)
infer/inference_qwenvl.py:300
MethodINPUT_TYPES
(s)
x2i_comfyui/nodes.py:20
MethodINPUT_TYPES
(s)
x2i_comfyui/nodes.py:40
MethodINPUT_TYPES
(s)
x2i_comfyui/nodes.py:59
MethodINPUT_TYPES
(s)
x2i_comfyui/nodes.py:86
MethodINPUT_TYPES
(s)
x2i_comfyui/nodes.py:115
MethodINPUT_TYPES
(s)
x2i_comfyui/nodes.py:144
Method__call__
(self, x: torch.Tensor)
minicpm/modeling_minicpmo.py:2292
Method__call__
(self, input_ids: torch.LongTensor, scores: torch.FloatTensor)
minicpm/modeling_minicpmo.py:2542
Method__call__
( self, text: Union[TextInput, PreTokenizedInput, List[TextInput], List[PreTokenizedInput]],
minicpm/processing_minicpmo.py:61
Method__call__
audio: Tensor([num_channels, num_samples])
minicpm/processing_minicpmo.py:465
Method__del__
(self)
core/data/dataloader.py:175
Method__del__
(self)
core/data/dataloader.py:765
Method__init__
( self, hidden_size=768, intermediate_size=3072, num_hidden_layers=12,
minicpm/modeling_navit_siglip.py:92
Method__init__
(self, config: SiglipVisionConfig)
minicpm/modeling_navit_siglip.py:300
Method__init__
(self, config)
minicpm/modeling_navit_siglip.py:369
Method__init__
(self, *args, **kwargs)
minicpm/modeling_navit_siglip.py:448
Method__init__
(self, config: SiglipVisionConfig)
minicpm/modeling_navit_siglip.py:646
Method__init__
(self, config: SiglipVisionConfig)
minicpm/modeling_navit_siglip.py:774
Method__init__
(self, config: SiglipVisionConfig)
minicpm/modeling_navit_siglip.py:856
← previousnext →201–300 of 612, ranked by callers