Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/chaojie/ComfyUI-Open-Sora-Plan
/ types & classes
Types & classes
270 in github.com/chaojie/ComfyUI-Open-Sora-Plan
⨍
Functions
1,253
◇
Types & classes
270
↓ 18 callers
Class
ResnetBlock
opensora/models/ae/imagebase/vqvae/model.py:78
↓ 16 callers
Class
CausalConv3d
opensora/models/ae/videobase/modules/conv.py:44
↓ 11 callers
Class
Unit3D
opensora/eval/fvd/videogpt/pytorch_i3d.py:37
↓ 10 callers
Class
AttnBlock
opensora/models/ae/imagebase/vqvae/model.py:140
↓ 9 callers
Class
InceptionModule
opensora/eval/fvd/videogpt/pytorch_i3d.py:107
↓ 7 callers
Class
NetLinLayer
A single linear layer which does a 1x1 conv
opensora/eval/flolpips/flolpips.py:167
↓ 6 callers
Class
CausalConv3d
opensora/models/ae/videobase/causal_vqvae/modeling_causalvqvae.py:183
↓ 6 callers
Class
DecordInit
Using Decord(https://github.com/dmlc/decord) to initialize the video_reader.
opensora/utils/dataset_utils.py:13
↓ 6 callers
Class
SamePadConv3d
opensora/models/ae/videobase/vqvae/modeling_vqvae.py:365
↓ 5 callers
Class
Decoder
opensora/eval/flolpips/pwcnet.py:146
↓ 5 callers
Class
MaxPool3dSamePadding
opensora/eval/fvd/videogpt/pytorch_i3d.py:7
↓ 5 callers
Class
NetLinLayer
A single linear layer which does a 1x1 conv
opensora/models/ae/videobase/losses/lpips.py:65
↓ 5 callers
Class
Registry
The registry that provides name -> object mapping, to support third-party users' custom modules. To create a registry (e.g. a backbone r
opensora/models/super_resolution/basicsr/utils/registry.py:4
↓ 5 callers
Class
Upsample
opensora/models/ae/imagebase/vqvae/model.py:38
↓ 4 callers
Class
Attention
r""" A cross attention layer. Parameters: query_dim (`int`): The number of channels in the query. cross_attention
opensora/models/diffusion/latte/modules.py:173
↓ 4 callers
Class
AttentionResidualBlock
opensora/models/ae/videobase/causal_vqvae/modeling_causalvqvae.py:236
↓ 4 callers
Class
CenterCropVideo
opensora/dataset/transform.py:380
↓ 4 callers
Class
ResidualBlock
opensora/models/frame_interpolation/networks/blocks/feat_enc.py:64
↓ 4 callers
Class
VideoGenPipeline
r""" Pipeline for text-to-image generation using PixArt-Alpha. This model inherits from [`DiffusionPipeline`]. Check the superclass documenta
opensora/sample/pipeline_videogen.py:71
↓ 3 callers
Class
AttnProcessor2_0
r""" Processor for implementing scaled dot-product attention (enabled by default if you're using PyTorch 2.0).
opensora/models/diffusion/latte/modules.py:850
↓ 3 callers
Class
DiagonalGaussianDistribution
opensora/models/ae/videobase/utils/distrib_utils.py:4
↓ 3 callers
Class
Downsample
opensora/models/ae/imagebase/vqvae/model.py:56
↓ 3 callers
Class
FeedForward
r""" A feed-forward layer. Parameters: dim (`int`): The number of channels in the input. dim_out (`int`, *optional*): The num
opensora/models/diffusion/latte/modules.py:1053
↓ 3 callers
Class
LPIPS
opensora/models/ae/videobase/losses/lpips.py:9
↓ 3 callers
Class
MultiHeadAttention
opensora/models/ae/videobase/causal_vqvae/modeling_causalvqvae.py:386
↓ 3 callers
Class
MultiHeadAttention
opensora/models/ae/videobase/vqvae/modeling_vqvae.py:247
↓ 3 callers
Class
ResBlock
opensora/models/frame_interpolation/networks/blocks/ifrnet.py:16
↓ 3 callers
Class
ToTensorVideo
Convert tensor data type from uint8 to float, divide value by 255.0 and permute the dimensions of clip tensor
opensora/dataset/transform.py:435
↓ 3 callers
Class
VQVAEConfiguration
opensora/models/ae/videobase/vqvae/configuration_vqvae.py:4
↓ 2 callers
Class
AttentionResidualBlock
opensora/models/ae/videobase/vqvae/modeling_vqvae.py:101
↓ 2 callers
Class
BottleneckBlock
opensora/models/frame_interpolation/networks/blocks/feat_enc.py:5
↓ 2 callers
Class
FileClient
A general file client to access files in different backend. The client loads a file or text in a specified backend from its path and return i
opensora/models/super_resolution/basicsr/utils/file_client.py:132
↓ 2 callers
Class
FloLPIPS
opensora/eval/flolpips/flolpips.py:254
↓ 2 callers
Class
GatedSelfAttentionDense
r""" A gated self-attention dense layer that combines visual features and object features. Parameters: query_dim (`int`): The number
opensora/models/diffusion/latte/modules.py:1012
↓ 2 callers
Class
GaussianDiffusion
Utilities for training and sampling diffusion models. Original ported from this codebase: https://github.com/hojonathanho/diffusion/blob/
opensora/models/diffusion/diffusion/gaussian_diffusion.py:144
↓ 2 callers
Class
IntermediateDecoder
opensora/models/frame_interpolation/networks/blocks/ifrnet.py:94
↓ 2 callers
Class
KeyNotFoundError
opensora/utils/taming_download.py:49
↓ 2 callers
Class
LatteT2V
opensora/models/diffusion/latte/modeling_latte.py:25
↓ 2 callers
Class
RandomCropVideo
opensora/dataset/transform.py:180
↓ 2 callers
Class
ResnetBlock3D
opensora/models/ae/videobase/modules/resnet_block.py:54
↓ 2 callers
Class
TemporalAttnBlock
opensora/models/ae/videobase/modules/attention.py:177
↓ 2 callers
Class
TemporalRandomCrop
Temporally crop the given frame indices at a random location. Args: size (int): Desired length of frames will be seen in the model.
opensora/dataset/transform.py:485
↓ 2 callers
Class
VideoDataset
Generic dataset for videos files stored in folders Returns BCTHW videos in the range [-0.5, 0.5]
opensora/models/ae/videobase/dataset_videobase.py:48
↓ 2 callers
Class
VideoPipelineOutput
opensora/sample/pipeline_videogen.py:67
↓ 2 callers
Class
_WrappedModel
opensora/models/diffusion/diffusion/respace.py:119
↓ 2 callers
Class
ode
ODE solver class
opensora/models/diffusion/transport/integrators.py:77
↓ 1 callers
Class
AdaLayerNormSingle
r""" Norm layer adaptive layer norm single (adaLN-single). As proposed in PixArt-Alpha (see: https://arxiv.org/abs/2310.00426; Section 2.3).
opensora/models/diffusion/latte/modules.py:1684
↓ 1 callers
Class
AttnBlock
opensora/models/ae/videobase/modules/attention.py:132
↓ 1 callers
Class
AttnBlock3D
Compatible with old versions, there are issues, use with caution.
opensora/models/ae/videobase/modules/attention.py:40
↓ 1 callers
Class
AverageMeter
opensora/models/frame_interpolation/utils/utils.py:12
↓ 1 callers
Class
AxialAttention
opensora/models/ae/videobase/causal_vqvae/modeling_causalvqvae.py:537
↓ 1 callers
Class
AxialAttention
opensora/models/ae/videobase/vqvae/modeling_vqvae.py:447
↓ 1 callers
Class
AxialBlock
opensora/models/ae/videobase/causal_vqvae/modeling_causalvqvae.py:212
↓ 1 callers
Class
AxialBlock
opensora/models/ae/videobase/vqvae/modeling_vqvae.py:77
↓ 1 callers
Class
BasicTransformerBlock
r""" A basic Transformer block. Parameters: dim (`int`): The number of channels in the input and output. num_attention_heads
opensora/models/diffusion/latte/modules.py:1399
↓ 1 callers
Class
BasicTransformerBlock_
r""" A basic Transformer block. Parameters: dim (`int`): The number of channels in the input and output. num_attention_heads
opensora/models/diffusion/latte/modules.py:1111
↓ 1 callers
Class
BasicUpdateBlock
opensora/models/frame_interpolation/networks/blocks/raft.py:88
↓ 1 callers
Class
BidirCorrBlock
opensora/models/frame_interpolation/networks/blocks/raft.py:142
↓ 1 callers
Class
Block
opensora/models/super_resolution/basicsr/archs/rgt_arch.py:473
↓ 1 callers
Class
CLIPEmbedder
A class for embedding texts and images using a pretrained CLIP model.
opensora/models/text_encoder/clip.py:10
↓ 1 callers
Class
CaptionProjection
Projects caption embeddings. Also handles dropout for classifier-free guidance. Adapted from https://github.com/PixArt-alpha/PixArt-alpha/bl
opensora/models/diffusion/latte/modules.py:86
↓ 1 callers
Class
CaptionRefiner
opensora/models/captioner/caption_refiner/caption_refiner.py:10
↓ 1 callers
Class
CausalVAEModel
opensora/models/ae/videobase/causal_vae/modeling_causalvae.py:252
↓ 1 callers
Class
CausalVQVAEConfiguration
opensora/models/ae/videobase/causal_vqvae/configuration_causalvqvae.py:4
↓ 1 callers
Class
CenterCropResizeVideo
First use the short side for cropping length, center crop video, then resize to the specified size
opensora/dataset/transform.py:282
↓ 1 callers
Class
CharbonnierLoss
Charbonnier loss (one variant of Robust L1Loss, a differentiable variant of L1Loss). Described in "Deep Laplacian Pyramid Networks for Fast a
opensora/models/super_resolution/basicsr/losses/losses.py:86
↓ 1 callers
Class
Codebook
opensora/models/ae/videobase/causal_vqvae/modeling_causalvqvae.py:255
↓ 1 callers
Class
Codebook
opensora/models/ae/videobase/vqvae/modeling_vqvae.py:121
↓ 1 callers
Class
Collate
opensora/utils/dataset_utils.py:45
↓ 1 callers
Class
CombinedTimestepSizeEmbeddings
For PixArt-Alpha. Reference: https://github.com/PixArt-alpha/PixArt-alpha/blob/0f55e922376d8b797edd44d25d0e7464b260dcab/diffusion/model/
opensora/models/diffusion/latte/modules.py:32
↓ 1 callers
Class
Decoder
opensora/models/ae/videobase/causal_vae/modeling_causalvae.py:138
↓ 1 callers
Class
Decoder
opensora/models/ae/videobase/causal_vqvae/modeling_causalvqvae.py:473
↓ 1 callers
Class
Decoder
opensora/models/ae/videobase/vqvae/modeling_vqvae.py:336
↓ 1 callers
Class
Decoder
opensora/models/ae/imagebase/vqvae/model.py:436
↓ 1 callers
Class
Dist2LogitLayer
takes 2 distances, puts through fc layers, spits out value between [0,1] (if use_sigmoid is True)
opensora/eval/flolpips/flolpips.py:179
↓ 1 callers
Class
DummyDataset
opensora/eval/eval_clip_score.py:53
↓ 1 callers
Class
DynamicPosBias
Dynamic Relative Position Bias. Args: dim (int): Number of input channels. num_heads (int): Number of attention heads. re
opensora/models/super_resolution/basicsr/archs/rgt_arch.py:85
↓ 1 callers
Class
EMAVectorQuantizer
opensora/models/ae/imagebase/vqvae/quantize.py:364
↓ 1 callers
Class
EmbeddingEMA
opensora/models/ae/imagebase/vqvae/quantize.py:334
↓ 1 callers
Class
Encoder
opensora/models/ae/videobase/causal_vae/modeling_causalvae.py:13
↓ 1 callers
Class
Encoder
opensora/models/ae/videobase/causal_vqvae/modeling_causalvqvae.py:350
↓ 1 callers
Class
Encoder
opensora/models/ae/videobase/vqvae/modeling_vqvae.py:217
↓ 1 callers
Class
Encoder
opensora/models/ae/imagebase/vqvae/model.py:342
↓ 1 callers
Class
Encoder
opensora/models/frame_interpolation/networks/blocks/ifrnet.py:55
↓ 1 callers
Class
Extractor
opensora/eval/flolpips/pwcnet.py:75
↓ 1 callers
Class
FullAttention
opensora/models/ae/videobase/causal_vqvae/modeling_causalvqvae.py:510
↓ 1 callers
Class
FullAttention
opensora/models/ae/videobase/vqvae/modeling_vqvae.py:419
↓ 1 callers
Class
Gate
opensora/models/super_resolution/basicsr/archs/rgt_arch.py:42
↓ 1 callers
Class
GumbelQuantize
credit to @karpathy: https://github.com/karpathy/deep-vector-quantization/blob/main/model.py (thanks!) Gumbel Softmax trick quantizer Cat
opensora/models/ae/imagebase/vqvae/quantize.py:110
↓ 1 callers
Class
GumbelVQ
opensora/models/ae/imagebase/vqvae/vqgan.py:276
↓ 1 callers
Class
InceptionI3d
Inception-v1 I3D architecture. The model is introduced in: Quo Vadis, Action Recognition? A New Model and the Kinetics Dataset Joa
opensora/eval/fvd/videogpt/pytorch_i3d.py:135
↓ 1 callers
Class
InitDecoder
opensora/models/frame_interpolation/networks/blocks/ifrnet.py:78
↓ 1 callers
Class
InputPadder
Pads images such that dimensions are divisible by divisor
opensora/models/frame_interpolation/utils/utils.py:54
↓ 1 callers
Class
L1Loss
L1 (mean absolute error, MAE) loss. Args: loss_weight (float): Loss weight for L1 loss. Default: 1.0. reduction (str): Specifies
opensora/models/super_resolution/basicsr/losses/losses.py:30
↓ 1 callers
Class
L_SA
opensora/models/super_resolution/basicsr/archs/rgt_arch.py:226
↓ 1 callers
Class
LargeEncoder
opensora/models/frame_interpolation/networks/blocks/feat_enc.py:267
↓ 1 callers
Class
LinAttnBlock
to match AttnBlock usage
opensora/models/ae/videobase/modules/attention.py:33
↓ 1 callers
Class
LinearScalingRoPE1D
Code from https://github.com/huggingface/transformers/blob/main/src/transformers/models/llama/modeling_llama.py#L148
opensora/models/diffusion/utils/pos_embed.py:204
↓ 1 callers
Class
LinearScalingRoPE2D
Code from https://github.com/huggingface/transformers/blob/main/src/transformers/models/llama/modeling_llama.py#L148
opensora/models/diffusion/utils/pos_embed.py:139
↓ 1 callers
Class
LongSideResizeVideo
First use the long side, then resize to the specified size
opensora/dataset/transform.py:242
next →
1–100 of 270, ranked by callers