Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/ali-vilab/TeaCache
/ types & classes
Types & classes
227 in github.com/ali-vilab/TeaCache
⨍
Functions
1,040
◇
Types & classes
227
↓ 16 callers
Class
CausalConv3d
videosys/models/autoencoders/autoencoder_kl_open_sora_plan_v110.py:1117
↓ 16 callers
Class
CausalConv3d
videosys/models/autoencoders/autoencoder_kl_open_sora_plan.py:1114
↓ 15 callers
Class
CausalConv3d
videosys/models/autoencoders/autoencoder_kl_open_sora_plan_v120.py:40
↓ 12 callers
Class
AdaLayerNorm
r""" Norm layer modified to incorporate timestep embeddings. Parameters: embedding_dim (`int`): The size of each embedding vector.
videosys/models/modules/normalization.py:49
↓ 12 callers
Class
VideoSysEngine
this is partly inspired by vllm
videosys/core/engine.py:13
↓ 9 callers
Class
Attention
r""" A cross attention layer. Parameters: query_dim (`int`): The number of channels in the query. cross_attention
videosys/models/transformers/open_sora_plan_transformer_3d.py:441
↓ 9 callers
Class
CogVideoXCausalConv3d
r"""A 3D causal convolution layer that pads the input tensor to ensure causality in CogVideoX Model. Args: in_channels (`int`): Number of
videosys/models/autoencoders/autoencoder_kl_cogvideox.py:60
↓ 8 callers
Class
VideoSysPipelineOutput
videosys/core/pipeline.py:52
↓ 6 callers
Class
ParallelManager
videosys/core/parallel_mgr.py:9
↓ 5 callers
Class
FeedForward
r""" A feed-forward layer. Parameters: dim (`int`): The number of channels in the input. dim_out (`int`, *optional*): The num
videosys/models/transformers/latte_transformer_3d.py:92
↓ 4 callers
Class
Attention
r""" A cross attention layer. Parameters: query_dim (`int`): The number of channels in the query. cross_attention
videosys/models/transformers/open_sora_plan_v110_transformer_3d.py:428
↓ 4 callers
Class
CogVideoXSafeConv3d
r""" A 3D convolution layer that splits the input tensor into smaller parts to avoid OOM in CogVideoX Model.
videosys/models/autoencoders/autoencoder_kl_cogvideox.py:31
↓ 4 callers
Class
OpenSoraT2V
A 2D Transformer model for image-like data. Parameters: num_attention_heads (`int`, *optional*, defaults to 16): The number of heads
videosys/models/transformers/open_sora_plan_v120_transformer_3d.py:1464
↓ 4 callers
Class
ResBlock
videosys/models/autoencoders/autoencoder_kl_open_sora.py:127
↓ 3 callers
Class
AttnProcessor2_0
r""" Processor for implementing scaled dot-product attention (enabled by default if you're using PyTorch 2.0).
videosys/models/transformers/open_sora_plan_v110_transformer_3d.py:1125
↓ 3 callers
Class
AttnProcessor2_0
r""" Processor for implementing scaled dot-product attention (enabled by default if you're using PyTorch 2.0).
videosys/models/transformers/open_sora_plan_transformer_3d.py:1138
↓ 3 callers
Class
CogVideoXConfig
This config is to instantiate a `CogVideoXPipeline` class for video generation. To be specific, this config will be passed to engine by `Vid
videosys/pipelines/cogvideox/pipeline_cogvideox.py:48
↓ 3 callers
Class
CogVideoXResnetBlock3D
r""" A 3D ResNet block used in the CogVideoX model. Args: in_channels (`int`): Number of input channels. out_chan
videosys/models/autoencoders/autoencoder_kl_cogvideox.py:182
↓ 3 callers
Class
CogVideoXSpatialNorm3D
r""" Spatially conditioned normalization as defined in https://arxiv.org/abs/2209.09002. This implementation is specific to 3D-video like data
videosys/models/autoencoders/autoencoder_kl_cogvideox.py:139
↓ 3 callers
Class
DiagonalGaussianDistribution
videosys/models/autoencoders/autoencoder_kl_open_sora_plan_v110.py:45
↓ 3 callers
Class
DiagonalGaussianDistribution
videosys/models/autoencoders/autoencoder_kl_open_sora_plan_v120.py:199
↓ 3 callers
Class
DiagonalGaussianDistribution
videosys/models/autoencoders/autoencoder_kl_open_sora_plan.py:45
↓ 3 callers
Class
FeedForward
r""" A feed-forward layer. Parameters: dim (`int`): The number of channels in the input. dim_out (`int`, *optional*): The num
videosys/models/transformers/open_sora_plan_v110_transformer_3d.py:1312
↓ 3 callers
Class
FeedForward
r""" A feed-forward layer. Parameters: dim (`int`): The number of channels in the input. dim_out (`int`, *optional*): The num
videosys/models/transformers/open_sora_plan_transformer_3d.py:1325
↓ 3 callers
Class
GatedSelfAttentionDense
r""" A gated self-attention dense layer that combines visual features and object features. Parameters: query_dim (`int`): The number
videosys/models/transformers/latte_transformer_3d.py:51
↓ 3 callers
Class
LatteConfig
This config is to instantiate a `LattePipeline` class for video generation. To be specific, this config will be passed to engine by `VideoSy
videosys/pipelines/latte/pipeline_latte.py:79
↓ 3 callers
Class
OpenSoraConfig
This config is to instantiate a `OpenSoraPipeline` class for video generation. To be specific, this config will be passed to engine by `Vide
videosys/pipelines/open_sora/pipeline_open_sora.py:72
↓ 3 callers
Class
OpenSoraPlanConfig
This config is to instantiate a `OpenSoraPlanPipeline` class for video generation. To be specific, this config will be passed to engine by `
videosys/pipelines/open_sora_plan/pipeline_open_sora_plan.py:123
↓ 3 callers
Class
PatchEmbed
2D Image to Patch Embedding
videosys/models/transformers/open_sora_plan_transformer_3d.py:374
↓ 2 callers
Class
AdaLayerNormSingle
r""" Norm layer adaptive layer norm single (adaLN-single). As proposed in PixArt-Alpha (see: https://arxiv.org/abs/2310.00426; Section 2.3).
videosys/models/transformers/latte_transformer_3d.py:846
↓ 2 callers
Class
Attention
videosys/models/transformers/open_sora_plan_v120_transformer_3d.py:647
↓ 2 callers
Class
CausalConv3d
videosys/models/autoencoders/autoencoder_kl_open_sora.py:89
↓ 2 callers
Class
CogVideoXLayerNormZero
videosys/models/modules/normalization.py:25
↓ 2 callers
Class
CogVideoXMidBlock3D
r""" A middle block used in the CogVideoX model. Args: in_channels (`int`): Number of input channels. temb_channe
videosys/models/autoencoders/autoencoder_kl_cogvideox.py:409
↓ 2 callers
Class
DiagonalGaussianDistribution
videosys/models/autoencoders/autoencoder_kl_open_sora.py:21
↓ 2 callers
Class
FeedForward
r""" A feed-forward layer. Parameters: dim (`int`): The number of channels in the input. dim_out (`int`, *optional*): The num
videosys/models/transformers/vchitect_transformer_3d.py:178
↓ 2 callers
Class
GatedSelfAttentionDense
r""" A gated self-attention dense layer that combines visual features and object features. Parameters: query_dim (`int`): The number
videosys/models/transformers/open_sora_plan_v110_transformer_3d.py:1271
↓ 2 callers
Class
GatedSelfAttentionDense
r""" A gated self-attention dense layer that combines visual features and object features. Parameters: query_dim (`int`): The number
videosys/models/transformers/open_sora_plan_transformer_3d.py:1284
↓ 2 callers
Class
LatteT2V
videosys/models/transformers/open_sora_plan_v110_transformer_3d.py:2123
↓ 2 callers
Class
LatteT2V
videosys/models/transformers/open_sora_plan_transformer_3d.py:2135
↓ 2 callers
Class
ResnetBlock3D
videosys/models/autoencoders/autoencoder_kl_open_sora_plan_v110.py:1418
↓ 2 callers
Class
ResnetBlock3D
videosys/models/autoencoders/autoencoder_kl_open_sora_plan.py:1415
↓ 2 callers
Class
Result
Result of task dispatched to worker
videosys/core/mp_utils.py:52
↓ 2 callers
Class
STDiT3Block
videosys/models/transformers/open_sora_transformer_3d.py:98
↓ 2 callers
Class
TemporalAttnBlock
videosys/models/autoencoders/autoencoder_kl_open_sora_plan_v110.py:1033
↓ 2 callers
Class
TemporalAttnBlock
videosys/models/autoencoders/autoencoder_kl_open_sora_plan.py:1030
↓ 2 callers
Class
ToTensorVideo
Convert tensor data type from uint8 to float, divide value by 255.0 and permute the dimensions of clip tensor
videosys/pipelines/open_sora/data_process.py:662
↓ 2 callers
Class
Transformer3DModelOutput
The output of [`Transformer2DModel`]. Args: sample (`torch.FloatTensor` of shape `(batch_size, num_channels, height, width)` or `(ba
videosys/models/transformers/latte_transformer_3d.py:882
↓ 2 callers
Class
Transformer3DModelOutput
The output of [`Transformer2DModel`]. Args: sample (`torch.FloatTensor` of shape `(batch_size, num_channels, height, width)` or `(ba
videosys/models/transformers/open_sora_plan_v110_transformer_3d.py:2110
↓ 1 callers
Class
AdaLayerNormSingle
r""" Norm layer adaptive layer norm single (adaLN-single). As proposed in PixArt-Alpha (see: https://arxiv.org/abs/2310.00426; Section 2.3).
videosys/models/transformers/open_sora_plan_v110_transformer_3d.py:2074
↓ 1 callers
Class
AdaLayerNormSingle
r""" Norm layer adaptive layer norm single (adaLN-single). As proposed in PixArt-Alpha (see: https://arxiv.org/abs/2310.00426; Section 2.3).
videosys/models/transformers/open_sora_plan_transformer_3d.py:2086
↓ 1 callers
Class
AttnBlock
videosys/models/autoencoders/autoencoder_kl_open_sora_plan_v110.py:994
↓ 1 callers
Class
AttnBlock
videosys/models/autoencoders/autoencoder_kl_open_sora_plan.py:991
↓ 1 callers
Class
AttnBlock3D
Compatible with old versions, there are issues, use with caution.
videosys/models/autoencoders/autoencoder_kl_open_sora_plan_v110.py:899
↓ 1 callers
Class
AttnBlock3D
Compatible with old versions, there are issues, use with caution.
videosys/models/autoencoders/autoencoder_kl_open_sora_plan.py:896
↓ 1 callers
Class
AttnProcessor2_0
r""" Processor for implementing scaled dot-product attention (enabled by default if you're using PyTorch 2.0).
videosys/models/transformers/open_sora_plan_v120_transformer_3d.py:837
↓ 1 callers
Class
BasicTransformerBlock
r""" A basic Transformer block. Parameters: dim (`int`): The number of channels in the input and output. num_attention_heads
videosys/models/transformers/open_sora_plan_v120_transformer_3d.py:1092
↓ 1 callers
Class
BasicTransformerBlock
r""" A basic Transformer block. Parameters: dim (`int`): The number of channels in the input and output. num_attention_heads
videosys/models/transformers/latte_transformer_3d.py:150
↓ 1 callers
Class
BasicTransformerBlock
r""" A basic Transformer block. Parameters: dim (`int`): The number of channels in the input and output. num_attention_heads
videosys/models/transformers/open_sora_plan_v110_transformer_3d.py:1734
↓ 1 callers
Class
BasicTransformerBlock
r""" A basic Transformer block. Parameters: dim (`int`): The number of channels in the input and output. num_attention_heads
videosys/models/transformers/open_sora_plan_transformer_3d.py:1744
↓ 1 callers
Class
BasicTransformerBlock_
r""" A basic Transformer block. Parameters: dim (`int`): The number of channels in the input and output. num_attention_heads
videosys/models/transformers/latte_transformer_3d.py:521
↓ 1 callers
Class
BasicTransformerBlock_
r""" A basic Transformer block. Parameters: dim (`int`): The number of channels in the input and output. num_attention_heads
videosys/models/transformers/open_sora_plan_v110_transformer_3d.py:1370
↓ 1 callers
Class
BasicTransformerBlock_
r""" A basic Transformer block. Parameters: dim (`int`): The number of channels in the input and output. num_attention_heads
videosys/models/transformers/open_sora_plan_transformer_3d.py:1383
↓ 1 callers
Class
CaptionProjection
Projects caption embeddings. Also handles dropout for classifier-free guidance. Adapted from https://github.com/PixArt-alpha/PixArt-alpha/bl
videosys/models/transformers/open_sora_plan_v110_transformer_3d.py:340
↓ 1 callers
Class
CaptionProjection
Projects caption embeddings. Also handles dropout for classifier-free guidance. Adapted from https://github.com/PixArt-alpha/PixArt-alpha/bl
videosys/models/transformers/open_sora_plan_transformer_3d.py:353
↓ 1 callers
Class
CogVideoXAttnProcessor2_0
r""" Processor for implementing scaled dot-product attention for the CogVideoX model. It applies a rotary embedding on query and key vectors,
videosys/models/transformers/cogvideox_transformer_3d.py:35
↓ 1 callers
Class
CogVideoXBlock
r""" Transformer block used in [CogVideoX](https://github.com/THUDM/CogVideo) model. Parameters: dim (`int`): The number
videosys/models/transformers/cogvideox_transformer_3d.py:179
↓ 1 callers
Class
CogVideoXDecoder3D
r""" The `CogVideoXDecoder3D` layer of a variational autoencoder that decodes its latent representation into an output sample. Args:
videosys/models/autoencoders/autoencoder_kl_cogvideox.py:732
↓ 1 callers
Class
CogVideoXDownBlock3D
r""" A downsampling block used in the CogVideoX model. Args: in_channels (`int`): Number of input channels. out_c
videosys/models/autoencoders/autoencoder_kl_cogvideox.py:303
↓ 1 callers
Class
CogVideoXDownsample3D
r""" A 3D Downsampling layer using in [CogVideoX]() by Tsinghua University & ZhipuAI Args: in_channels (`int`): Number of
videosys/models/modules/downsampling.py:6
↓ 1 callers
Class
CogVideoXEncoder3D
r""" The `CogVideoXEncoder3D` layer of a variational autoencoder that encodes its input into a latent representation. Args: in_channe
videosys/models/autoencoders/autoencoder_kl_cogvideox.py:598
↓ 1 callers
Class
CogVideoXPABConfig
videosys/pipelines/cogvideox/pipeline_cogvideox.py:34
↓ 1 callers
Class
CogVideoXPatchEmbed
videosys/models/modules/embeddings.py:14
↓ 1 callers
Class
CogVideoXUpBlock3D
r""" An upsampling block used in the CogVideoX model. Args: in_channels (`int`): Number of input channels. out_ch
videosys/models/autoencoders/autoencoder_kl_cogvideox.py:493
↓ 1 callers
Class
CogVideoXUpsample3D
r""" A 3D Upsample layer using in CogVideoX by Tsinghua University & ZhipuAI # Todo: Wait for paper relase. Args: in_channels (`int`)
videosys/models/modules/upsampling.py:6
↓ 1 callers
Class
CombinedTimestepSizeEmbeddings
For PixArt-Alpha. Reference: https://github.com/PixArt-alpha/PixArt-alpha/blob/0f55e922376d8b797edd44d25d0e7464b260dcab/diffusion/model/
videosys/models/transformers/open_sora_plan_v110_transformer_3d.py:285
↓ 1 callers
Class
CombinedTimestepSizeEmbeddings
For PixArt-Alpha. Reference: https://github.com/PixArt-alpha/PixArt-alpha/blob/0f55e922376d8b797edd44d25d0e7464b260dcab/diffusion/model/
videosys/models/transformers/open_sora_plan_transformer_3d.py:298
↓ 1 callers
Class
DDIMSchedulerOutput
Output class for the scheduler's `step` function output. Args: prev_sample (`torch.Tensor` of shape `(batch_size, num_channels, heig
videosys/schedulers/scheduling_dpm_cogvideox.py:26
↓ 1 callers
Class
DDIMSchedulerOutput
Output class for the scheduler's `step` function output. Args: prev_sample (`torch.Tensor` of shape `(batch_size, num_channels, heig
videosys/schedulers/scheduling_ddim_cogvideox.py:25
↓ 1 callers
Class
Decoder
videosys/models/autoencoders/autoencoder_kl_open_sora_plan_v110.py:251
↓ 1 callers
Class
Decoder
videosys/models/autoencoders/autoencoder_kl_open_sora_plan_v120.py:629
↓ 1 callers
Class
Decoder
videosys/models/autoencoders/autoencoder_kl_open_sora_plan.py:251
↓ 1 callers
Class
Decoder
Decoder Blocks.
videosys/models/autoencoders/autoencoder_kl_open_sora.py:275
↓ 1 callers
Class
DownSampler2d
videosys/models/transformers/open_sora_plan_v120_transformer_3d.py:793
↓ 1 callers
Class
DownSampler3d
videosys/models/transformers/open_sora_plan_v120_transformer_3d.py:735
↓ 1 callers
Class
Encoder
videosys/models/autoencoders/autoencoder_kl_open_sora_plan_v110.py:134
↓ 1 callers
Class
Encoder
videosys/models/autoencoders/autoencoder_kl_open_sora_plan_v120.py:509
↓ 1 callers
Class
Encoder
videosys/models/autoencoders/autoencoder_kl_open_sora_plan.py:134
↓ 1 callers
Class
Encoder
Encoder Blocks.
videosys/models/autoencoders/autoencoder_kl_open_sora.py:177
↓ 1 callers
Class
FeedForward_Conv2d
videosys/models/transformers/open_sora_plan_v120_transformer_3d.py:1033
↓ 1 callers
Class
JointTransformerBlock
r""" A Transformer block following the MMDiT architecture, introduced in Stable Diffusion 3. Reference: https://arxiv.org/abs/2403.03206
videosys/models/transformers/vchitect_transformer_3d.py:49
↓ 1 callers
Class
LattePABConfig
videosys/pipelines/latte/pipeline_latte.py:35
↓ 1 callers
Class
LinAttnBlock
to match AttnBlock usage
videosys/models/autoencoders/autoencoder_kl_open_sora_plan_v110.py:892
↓ 1 callers
Class
LinAttnBlock
to match AttnBlock usage
videosys/models/autoencoders/autoencoder_kl_open_sora_plan.py:889
↓ 1 callers
Class
LinearScalingRoPE1D
Code from https://github.com/huggingface/transformers/blob/main/src/transformers/models/llama/modeling_llama.py#L148
videosys/models/transformers/open_sora_plan_v110_transformer_3d.py:244
↓ 1 callers
Class
LinearScalingRoPE1D
Code from https://github.com/huggingface/transformers/blob/main/src/transformers/models/llama/modeling_llama.py#L148
videosys/models/transformers/open_sora_plan_transformer_3d.py:257
↓ 1 callers
Class
LinearScalingRoPE2D
Code from https://github.com/huggingface/transformers/blob/main/src/transformers/models/llama/modeling_llama.py#L148
videosys/models/transformers/open_sora_plan_v110_transformer_3d.py:187
↓ 1 callers
Class
LinearScalingRoPE2D
Code from https://github.com/huggingface/transformers/blob/main/src/transformers/models/llama/modeling_llama.py#L148
videosys/models/transformers/open_sora_plan_transformer_3d.py:200
↓ 1 callers
Class
OpenSoraAttention
videosys/models/modules/attentions.py:21
↓ 1 callers
Class
OpenSoraCaptionEmbedder
Embeds class labels into vector representations. Also handles label dropout for classifier-free guidance.
videosys/models/modules/embeddings.py:183
next →
1–100 of 227, ranked by callers