MCPcopy Create free account

hub / github.com/Soul-AILab/SoulX-FlashTalk / functions

Functions233 in github.com/Soul-AILab/SoulX-FlashTalk

↓ 14 callersMethodupdate
(self, update_value: torch.Tensor)
flash_talk/infinite_talk/utils/multitalk_utils.py:323
↓ 10 callersFunctionflash_attention
q: [B, Lq, Nq, C1]. k: [B, Lk, Nk, C1]. v: [B, Lk, Nk, C2]. Nq must be divisible by Nk. q_lens
flash_talk/wan/modules/attention.py:22
↓ 9 callersMethodclear_cache
(self)
flash_talk/wan/modules/vae.py:895
↓ 8 callersMethod__init__
(self, vocab_size, dim, dim_attn, dim_ffn,
flash_talk/wan/modules/t5.py:379
↓ 8 callersMethod__init__
( self, z_dim=16, vae_path="cache/vae_step_411000.pth", dtype=torch.float,
flash_talk/wan/modules/vae.py:958
↓ 8 callersMethod__init__
(self, dim, out_dim, patch_size, eps=1e-6)
flash_talk/infinite_talk/modules/multitalk_model.py:310
↓ 7 callersMethod__init__
(self, dim, out_dim, patch_size, eps=1e-6)
flash_talk/wan/modules/model.py:322
↓ 6 callersMethod__init__
(self, dim, mid_dim)
flash_talk/wan/modules/clip.py:96
↓ 6 callersFunctionhalf
(x)
flash_talk/wan/modules/attention.py:57
↓ 6 callersFunctionhalf
(x)
flash_talk/infinite_talk/distributed/xdit_context_parallel.py:191
↓ 6 callersFunctionrope_params
(max_seq_len, dim, theta=10000)
flash_talk/infinite_talk/modules/multitalk_model.py:32
↓ 5 callersMethodencode
video: one video with shape [1, C, T, H, W].
flash_talk/wan/modules/vae.py:1266
↓ 5 callersFunctionfp16_clamp
(x)
flash_talk/wan/modules/t5.py:25
↓ 4 callersFunctionget_audio_embedding
(pipeline, audio_array, audio_start_idx=-1, audio_end_idx=-1)
flash_talk/inference.py:49
↓ 4 callersFunctionnormalize_and_scale
(column, source_range, target_range, epsilon=1e-8)
flash_talk/infinite_talk/utils/multitalk_utils.py:70
↓ 4 callersFunctionqkv_fn
(x)
flash_talk/infinite_talk/distributed/xdit_context_parallel.py:195
↓ 4 callersFunctionrope_apply
x: [B, L, N, C]. grid_sizes: [B, 3]. freqs: [M, C // 2].
flash_talk/infinite_talk/distributed/xdit_context_parallel.py:32
↓ 4 callersFunctionrun_pipeline
(pipeline, audio_embedding)
flash_talk/inference.py:65
↓ 4 callersMethodtiled_encode
(self, x, scale)
flash_talk/wan/modules/vae.py:608
↓ 3 callersMethod_calculate_2d_grid
(self, latent_height, latent_width, world_size)
flash_talk/wan/modules/vae.py:1064
↓ 3 callersFunctionbasic_clean
(text)
flash_talk/wan/modules/tokenizers.py:12
↓ 3 callersFunctionrope_params
(max_seq_len, dim, theta=10000)
flash_talk/wan/modules/model.py:32
↓ 3 callersFunctionsinusoidal_embedding_1d
(dim, position)
flash_talk/infinite_talk/modules/multitalk_model.py:18
↓ 3 callersMethodunpatchify
r""" Reconstruct video tensors from patch embeddings. Args: x (List[Tensor]): List of patchified features
flash_talk/infinite_talk/modules/multitalk_model.py:664
↓ 2 callersMethod__init__
(self, vace_layers=None, vace_in_dim=None, model_type='vace
flash_talk/wan/modules/vace_model.py:68
↓ 2 callersMethod__init__
(self, vocab_size=250002, max_seq_len=514, type_size=1,
flash_talk/wan/modules/xlm_roberta.py:81
↓ 2 callersMethodblend_h
(self, a, b, blend_extent)
flash_talk/wan/modules/vae.py:600
↓ 2 callersMethodblend_v
(self, a, b, blend_extent)
flash_talk/wan/modules/vae.py:592
↓ 2 callersFunctioncount_conv3d
(model)
flash_talk/wan/modules/vae.py:528
↓ 2 callersMethoddecode
(self, z, scale)
flash_talk/wan/modules/vae.py:804
↓ 2 callersMethoddecode
(self, zs)
flash_talk/wan/modules/vae.py:1544
↓ 2 callersMethoddecode_dist
(self, zs, world_size, cur_rank, split_dim)
flash_talk/wan/modules/vae.py:1305
↓ 2 callersMethodencode
(self, x, scale, return_mu=False)
flash_talk/wan/modules/vae.py:770
↓ 2 callersMethodencode_dist
(self, video, world_size, cur_rank, split_dim)
flash_talk/wan/modules/vae.py:1089
↓ 2 callersMethodforward
(self, x)
flash_talk/wan/modules/clip.py:106
↓ 2 callersMethodforward
(self, x)
flash_talk/wan/modules/vae.py:586
↓ 2 callersMethodforward
r""" Forward pass through the diffusion model Args: x (List[Tensor]): List of input video tensors, each w
flash_talk/wan/modules/vace_model.py:155
↓ 2 callersFunctionget_attn_map_with_target
Args: query (torch.tensor): B M H K key (torch.tensor): B M H K shape (tuple): (N_t, N_h, N_w) ref_target_masks: [B, N
flash_talk/infinite_talk/utils/multitalk_utils.py:121
↓ 2 callersFunctionget_base_data
(pipeline, input_prompt, cond_image, base_seed)
flash_talk/inference.py:36
↓ 2 callersFunctionget_pipeline
(world_size, ckpt_dir, wav2vec_dir, cpu_offload=False)
flash_talk/inference.py:18
↓ 2 callersFunctionlinear_interpolation
(features, seq_len)
flash_talk/infinite_talk/audio_analysis/torch_utils.py:16
↓ 2 callersFunctionrgb_to_lab_torch
PyTorch GPU版本:RGB转Lab颜色空间(输入范围[0,1],张量形状任意,最后一维为通道数) 参考CIE 1931标准转换公式
flash_talk/infinite_talk/utils/multitalk_utils.py:465
↓ 2 callersFunctionrope_apply
(x, grid_sizes, freqs)
flash_talk/wan/modules/model.py:43
↓ 2 callersFunctionrope_apply
(x, grid_sizes, freqs)
flash_talk/infinite_talk/modules/multitalk_model.py:44
↓ 2 callersFunctionsinusoidal_embedding_1d
(dim, position)
flash_talk/wan/modules/model.py:18
↓ 2 callersFunctionsplit_token_counts_and_frame_ids
(T, token_frame, world_size, rank)
flash_talk/infinite_talk/utils/multitalk_utils.py:48
↓ 2 callersFunctiontorch_gc
()
flash_talk/infinite_talk/utils/multitalk_utils.py:44
↓ 2 callersFunctionumt5_xxl
(**kwargs)
flash_talk/wan/modules/t5.py:461
↓ 2 callersMethodunpatchify
r""" Reconstruct video tensors from patch embeddings. Args: x (List[Tensor]): List of patchified features
flash_talk/wan/modules/model.py:584
↓ 2 callersMethodvisual
(self, videos)
flash_talk/wan/modules/clip.py:527
↓ 2 callersFunctionwhitespace_clean
(text)
flash_talk/wan/modules/tokenizers.py:18
↓ 1 callersMethod__init__
( self, dim: int, encoder_hidden_states_dim: int, num_heads: int, qkv_
flash_talk/infinite_talk/modules/multitalk_attention.py:14
↓ 1 callersMethod__init__
(self, momentum: float)
flash_talk/infinite_talk/utils/multitalk_utils.py:319
↓ 1 callersMethod_clean
(self, text)
flash_talk/wan/modules/tokenizers.py:75
↓ 1 callersFunction_clip
(pretrained=False, pretrained_name=None, model_cls=XLMRobertaCLIP, return_transf
flash_talk/wan/modules/clip.py:434
↓ 1 callersMethod_norm
(self, x)
flash_talk/wan/modules/model.py:88
↓ 1 callersMethod_norm
(self, x)
flash_talk/infinite_talk/modules/multitalk_model.py:84
↓ 1 callersFunction_parse_args
()
generate_video.py:25
↓ 1 callersMethod_relative_position_bucket
(self, rel_pos)
flash_talk/wan/modules/t5.py:250
↓ 1 callersFunction_t5
(name, encoder_only=False, decoder_only=False, return_tokenizer=False, tokeniz
flash_talk/wan/modules/t5.py:420
↓ 1 callersFunction_validate_args
(args)
generate_video.py:18
↓ 1 callersFunction_video_vae
Autoencoder3d adapted from Stable Diffusion 1.x, 2.x and XL.
flash_talk/wan/modules/vae.py:923
↓ 1 callersFunctioncache_video
(tensor, save_file=None, fps=30, suffix='.mp4',
flash_talk/infinite_talk/utils/multitalk_utils.py:204
↓ 1 callersFunctioncalculate_x_ref_attn_map
(visual_q, ref_k, ref_target_masks, mode='mean', attn_bias=None)
flash_talk/infinite_talk/utils/multitalk_utils.py:81
↓ 1 callersFunctioncanonicalize
(text, keep_punctuation_exact_string=None)
flash_talk/wan/modules/tokenizers.py:24
↓ 1 callersFunctionclip_xlm_roberta_vit_h_14
( pretrained=False, pretrained_name='open-clip-xlm-roberta-large-vit-huge-14', **kwarg
flash_talk/wan/modules/clip.py:471
↓ 1 callersMethodcurrent_device
(self)
flash_talk/wan/modules/vae.py:1086
↓ 1 callersMethoddecode_dist_2d
(self, zs, world_size_h, world_size_w, cur_rank_h, cur_rank_w)
flash_talk/wan/modules/vae.py:1372
↓ 1 callersMethoddecode_dist_2d_stream
( self, zs, world_size_h, world_size_w, cur_rank_h, cur_rank_w )
flash_talk/wan/modules/vae.py:1457
↓ 1 callersMethoddecode_stream
(self, zs)
flash_talk/wan/modules/vae.py:1578
↓ 1 callersMethodencode_dist_2d
(self, video, world_size_h, world_size_w, cur_rank_h, cur_rank_w)
flash_talk/wan/modules/vae.py:1173
↓ 1 callersMethodforward
r""" Args: x(Tensor): Shape [B, L1, C] e(Tensor): Shape [B, C]
flash_talk/wan/modules/model.py:337
↓ 1 callersMethodforward
(self, x: torch.Tensor, encoder_hidden_states: torch.Tensor, shape=None, enable_sp=False, kv_seq=None, visual_
flash_talk/infinite_talk/modules/multitalk_attention.py:48
↓ 1 callersMethodforward
r""" Args: x(Tensor): Shape [B, L1, C] e(Tensor): Shape [B, C]
flash_talk/infinite_talk/modules/multitalk_model.py:325
↓ 1 callersMethodforward_vace
(self, x, vace_context, seq_len, kwargs)
flash_talk/wan/modules/vace_model.py:136
↓ 1 callersFunctiongenerate
(args)
generate_video.py:97
↓ 1 callersMethodgenerate
(self, audio_embedding)
flash_talk/src/pipeline/flash_talk_pipeline.py:274
↓ 1 callersFunctionget_device
(ulysses_degree, ring_degree)
flash_talk/src/distributed/usp_device.py:13
↓ 1 callersFunctionget_parallel_degree
(world_size, num_heads)
flash_talk/src/distributed/usp_device.py:7
↓ 1 callersMethodinit_weights
r""" Initialize model parameters using Xavier initialization.
flash_talk/wan/modules/model.py:609
↓ 1 callersMethodinit_weights
r""" Initialize model parameters using Xavier initialization.
flash_talk/infinite_talk/modules/multitalk_model.py:689
↓ 1 callersFunctionlab_to_rgb_torch
PyTorch GPU版本:Lab转RGB颜色空间(输出范围[0,1],张量形状任意,最后一维为通道数)
flash_talk/infinite_talk/utils/multitalk_utils.py:512
↓ 1 callersFunctionloudness_norm
(audio_array, sr=16000, lufs=-23)
flash_talk/infinite_talk/utils/multitalk_utils.py:679
↓ 1 callersFunctionmatch_and_blend_colors_torch
全GPU批量运算版本:将视频chunk的颜色匹配到参考图像并混合(支持B>1、T帧并行) Args: source_chunk (torch.Tensor): 视频chunk (B, C, T, H, W),范围[-1, 1] refere
flash_talk/infinite_talk/utils/multitalk_utils.py:561
↓ 1 callersFunctionpad_freqs
(original_tensor, target_len)
flash_talk/infinite_talk/distributed/xdit_context_parallel.py:18
↓ 1 callersFunctionpos_interpolate
(pos, seq_len)
flash_talk/wan/modules/clip.py:22
↓ 1 callersMethodprecompute_freqs_cis_1d
(self, pos_indices)
flash_talk/infinite_talk/utils/multitalk_utils.py:166
↓ 1 callersMethodprepare_params
(self, input_prompt, cond_image, targe
flash_talk/src/pipeline/flash_talk_pipeline.py:150
↓ 1 callersMethodpreprocess_audio
(self, speech_array, sr=16000, fps=25)
flash_talk/src/pipeline/flash_talk_pipeline.py:251
↓ 1 callersFunctionproject
( v0: torch.Tensor, # [B, C, T, H, W] v1: torch.Tensor, # [B, C, T, H, W] )
flash_talk/infinite_talk/utils/multitalk_utils.py:329
↓ 1 callersFunctionrand_name
(length=8, suffix='')
flash_talk/infinite_talk/utils/multitalk_utils.py:196
↓ 1 callersMethodreparameterize
(self, mu, log_var)
flash_talk/wan/modules/vae.py:883
↓ 1 callersFunctionresize_and_centercrop
Resize image or tensor to the target size without padding.
flash_talk/infinite_talk/utils/multitalk_utils.py:639
↓ 1 callersFunctionrotate_half
(x)
flash_talk/infinite_talk/utils/multitalk_utils.py:148
↓ 1 callersFunctionrun_inference
( ckpt_dir, wav2vec_dir, input_prompt, cond_image, audio_path, audio_encode_mode,
gradio_app.py:144
↓ 1 callersFunctionrun_multi_gpu_inference
Executes the inference using torchrun for Multi-GPU support.
gradio_app.py:21
↓ 1 callersMethodsample
(self, imgs, deterministic=False, scale=[0, 1])
flash_talk/wan/modules/vae.py:888
↓ 1 callersFunctionsave_video
(frames_list, video_path, audio_path, fps)
generate_video.py:80
↓ 1 callersFunctionsave_video
(frames, save_path, fps, quality=9, ffmpeg_params=None)
flash_talk/infinite_talk/utils/multitalk_utils.py:240
↓ 1 callersFunctionsave_video_to_file
Helper function to save the video, similar to generate_video.py but adapted for function usage.
gradio_app.py:110
next →1–100 of 233, ranked by callers