MCPcopy Create free account
hub / github.com/OpenImagingLab/FlashVSR / __init__

Method __init__

diffsynth/models/svd_image_encoder.py:28–36  ·  view source on GitHub ↗
(self, embed_dim=1280, layer_norm_eps=1e-5, num_encoder_layers=32, encoder_intermediate_size=5120, projection_dim=1024, num_heads=16, head_dim=80)

Source from the content-addressed store, hash-verified

26
27class SVDImageEncoder(torch.nn.Module):
28 def __init__(self, embed_dim=1280, layer_norm_eps=1e-5, num_encoder_layers=32, encoder_intermediate_size=5120, projection_dim=1024, num_heads=16, head_dim=80):
29 super().__init__()
30 self.embeddings = CLIPVisionEmbeddings(embed_dim=embed_dim)
31 self.pre_layernorm = torch.nn.LayerNorm(embed_dim, eps=layer_norm_eps)
32 self.encoders = torch.nn.ModuleList([
33 CLIPEncoderLayer(embed_dim, encoder_intermediate_size, num_heads=num_heads, head_dim=head_dim, use_quick_gelu=False)
34 for _ in range(num_encoder_layers)])
35 self.post_layernorm = torch.nn.LayerNorm(embed_dim, eps=layer_norm_eps)
36 self.visual_projection = torch.nn.Linear(embed_dim, projection_dim, bias=False)
37
38 def forward(self, pixel_values):
39 embeds = self.embeddings(pixel_values)

Callers 1

__init__Method · 0.45

Calls 2

CLIPEncoderLayerClass · 0.85

Tested by

no test coverage detected