↓ 6 callersMethodgenerate(
self,
image,
text=None,
seq_len=30,
max_seq_len=77,
temperat
inference/diffsynth/extensions/ImageQualityMetric/open_clip/coca_model.py:167
↓ 6 callersMethodload(self, file_path="", state_dict={}, device="cuda", torch_dtype=torch.float16, **kwargs)
inference/diffsynth/models/model_manager.py:143
↓ 6 callersMethodprocess_window_sum(self, frames_guide, blending_table, patch_match_engine, window_size, batch_size, desc="")
inference/diffsynth/extensions/FastBlend/runners/fast.py:77
↓ 6 callersMethodrun(self, frames_guide, frames_style, batch_size, window_size, ebsynth_config)
inference/diffsynth/extensions/FastBlend/__init__.py:26
↓ 5 callersMethodcontrol_noise_via_local_prompts(self, prompt_emb_global, prompt_emb_locals, masks, mask_scales, inference_callback, special_kwargs=None, spec
inference/diffsynth/pipelines/base.py:66
↓ 5 callersMethodencode_video(self, input_video, tiled=True, tile_size=(34, 34), tile_stride=(18, 16))
inference/diffsynth/pipelines/wan_video.py:276
↓ 5 callersFunctionmodulate(x, shift=None, scale=None, tr_shift=None, tr_scale=None, tr_token=None)
inference/diffsynth/models/hunyuan_video_dit.py:285
↓ 5 callersMethodupdate(self, source_guide, target_guide, source_style, target_style, nnf, err, upd_nnf)
inference/diffsynth/extensions/FastBlend/patch_match.py:159
↓ 4 callersFunctiongradient_checkpoint_forward(
model,
use_gradient_checkpointing,
use_gradient_checkpointing_offload,
*args,
**kwargs,
inference/diffsynth/vram_management/gradient_checkpointing.py:10
↓ 4 callersMethodinject_motion(self, x, rope_embs, mask_input, motion_latents, drop_motion_frames=True, add_last_motion=2)
inference/diffsynth/models/wan_video_dit_s2v.py:449
↓ 4 callersMethodprocess_entity_masks(self, hidden_states, prompt_emb, entity_prompt_emb, entity_masks, text_ids, image_ids, repeat_dim)
inference/diffsynth/models/flux_dit.py:378
↓ 3 callersMethod__init__(self, in_features, hidden_features=None, out_features=None, act_layer=nn.GELU, drop=0.)
inference/diffsynth/extensions/ImageQualityMetric/BLIP/vit.py:22
↓ 3 callersMethod__init__(self, disable_guidance_embedder=False, num_joint_blocks=5, num_single_blocks=10, num_mode=0, mode_dict={}, ad
inference/diffsynth/models/flux_controlnet.py:9