Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/Text-to-Audio/Make-An-Audio
/ types & classes
Types & classes
143 in github.com/Text-to-Audio/Make-An-Audio
⨍
Functions
679
◇
Types & classes
143
↓ 17 callers
Class
ResnetBlock
ldm/modules/diffusionmodules/model.py:82
↓ 16 callers
Class
ResBlock
A residual block that can optionally change the number of channels. :param channels: the number of input channels. :param emb_channels
ldm/modules/diffusionmodules/openaimodel.py:163
↓ 14 callers
Class
TimestepEmbedSequential
A sequential module that passes timestep embeddings to the children that support it as an extra input.
ldm/modules/diffusionmodules/openaimodel.py:74
↓ 8 callers
Class
AttentionBlock
An attention block that allows spatial positions to attend to each other. Originally ported from here, but adapted to the N-d case. ht
ldm/modules/diffusionmodules/openaimodel.py:278
↓ 6 callers
Class
Activation1d
vocoder/bigvgan/alias_free_torch/act.py:8
↓ 6 callers
Class
ConvBlock
wav_evaluation/models/audio.py:13
↓ 6 callers
Class
ConvBlock
ldm/modules/encoders/CLAP/audio.py:13
↓ 6 callers
Class
DDIMSampler
ldm/models/diffusion/ddim.py:12
↓ 6 callers
Class
SpatialTransformer
Transformer block for image-like data. First, project the input (aka embedding) and reshape to b, t, d. Then apply standard trans
ldm/modules/attention.py:218
↓ 5 callers
Class
Decoder
ldm/modules/diffusionmodules/model.py:462
↓ 5 callers
Class
Downsample
A downsampling layer with an optional convolution. :param channels: channels in the inputs and outputs. :param use_conv: a bool determ
ldm/modules/diffusionmodules/openaimodel.py:134
↓ 4 callers
Class
Encoder
ldm/modules/diffusionmodules/model.py:368
↓ 4 callers
Class
NLayerDiscriminator
Defines a PatchGAN discriminator as in Pix2Pix --> see https://github.com/junyanz/pytorch-CycleGAN-and-pix2pix/blob/master/models/networks.py
ldm/modules/discriminator/model.py:98
↓ 4 callers
Class
Upsample
An upsampling layer with an optional convolution. :param channels: channels in the inputs and outputs. :param use_conv: a bool determi
ldm/modules/diffusionmodules/openaimodel.py:91
↓ 4 callers
Class
Upsample
ldm/modules/diffusionmodules/model.py:42
↓ 3 callers
Class
Downsample
ldm/modules/diffusionmodules/model.py:60
↓ 3 callers
Class
LatentRescaler
ldm/modules/diffusionmodules/model.py:655
↓ 3 callers
Class
Snake
Implementation of a sine-based periodic activation function Shape: - Input: (B, C, T) - Output: (B, C, T), same shape as the
vocoder/bigvgan/activations.py:9
↓ 3 callers
Class
SnakeBeta
A modified Snake function which uses separate parameters for the magnitude of the periodic components Shape: - Input: (B, C, T)
vocoder/bigvgan/activations.py:62
↓ 3 callers
Class
TextEncoder
ldm/modules/encoders/CLAP/clap.py:42
↓ 3 callers
Class
VocoderBigVGAN
vocoder/bigvgan/models.py:393
↓ 2 callers
Class
Attention
ldm/modules/x_transformer.py:215
↓ 2 callers
Class
AttnBlock
ldm/modules/diffusionmodules/model.py:150
↓ 2 callers
Class
CrossAttention
ldm/modules/attention.py:152
↓ 2 callers
Class
DiagonalGaussianDistribution
ldm/modules/distributions/distributions.py:24
↓ 2 callers
Class
Encoder
ldm/modules/x_transformer.py:541
↓ 2 callers
Class
LitEma
ldm/modules/ema.py:5
↓ 2 callers
Class
MelNet
preprocess/NAT_mel.py:42
↓ 2 callers
Class
MultiWindowDiscriminator
ldm/modules/discriminator/multi_window_disc.py:66
↓ 2 callers
Class
Projection
wav_evaluation/models/clap.py:8
↓ 2 callers
Class
Projection
ldm/modules/encoders/CLAP/clap.py:8
↓ 2 callers
Class
QKVAttention
A module which performs QKV attention and splits in a different order.
ldm/modules/diffusionmodules/openaimodel.py:379
↓ 2 callers
Class
TransformerWrapper
ldm/modules/x_transformer.py:548
↓ 1 callers
Class
AbsolutePositionalEmbedding
ldm/modules/x_transformer.py:25
↓ 1 callers
Class
AttentionPool2d
Adapted from CLIP: https://github.com/openai/CLIP/blob/main/clip/model.py
ldm/modules/diffusionmodules/openaimodel.py:32
↓ 1 callers
Class
AudioEncoder
wav_evaluation/models/clap.py:22
↓ 1 callers
Class
AudioEncoder
ldm/modules/encoders/CLAP/clap.py:22
↓ 1 callers
Class
BERTTokenizer
Uses a pretrained BERT tokenizer by huggingface. Vocab size: 30522 (?)
ldm/modules/encoders/modules.py:54
↓ 1 callers
Class
BasicTransformerBlock
ldm/modules/attention.py:196
↓ 1 callers
Class
BigVGAN
vocoder/bigvgan/models.py:133
↓ 1 callers
Class
CLAP
wav_evaluation/models/clap.py:55
↓ 1 callers
Class
CLAP
ldm/modules/encoders/CLAP/clap.py:54
↓ 1 callers
Class
CLAPWrapper
A class for interfacing CLAP model.
wav_evaluation/models/CLAPWrapper.py:16
↓ 1 callers
Class
CLAPWrapper
A class for interfacing CLAP model.
ldm/modules/encoders/CLAP/CLAPWrapper.py:18
↓ 1 callers
Class
DiffusionWrapper
ldm/models/diffusion/ddpm.py:1358
↓ 1 callers
Class
Discriminator2DFactory
ldm/modules/discriminator/multi_window_disc.py:6
↓ 1 callers
Class
DiscriminatorP
vocoder/bigvgan/models.py:216
↓ 1 callers
Class
DiscriminatorR
vocoder/bigvgan/models.py:277
↓ 1 callers
Class
DownSample1d
vocoder/bigvgan/alias_free_torch/resample.py:36
↓ 1 callers
Class
FeedForward
ldm/modules/x_transformer.py:194
↓ 1 callers
Class
FeedForward
ldm/modules/attention.py:47
↓ 1 callers
Class
FixedPositionalEmbedding
ldm/modules/x_transformer.py:39
↓ 1 callers
Class
GEGLU
ldm/modules/x_transformer.py:184
↓ 1 callers
Class
GEGLU
ldm/modules/attention.py:37
↓ 1 callers
Class
GRUGating
ldm/modules/x_transformer.py:168
↓ 1 callers
Class
GroupNorm32
ldm/modules/diffusionmodules/util.py:214
↓ 1 callers
Class
LinAttnBlock
to match AttnBlock usage
ldm/modules/diffusionmodules/model.py:144
↓ 1 callers
Class
LowPassFilter1d
vocoder/bigvgan/alias_free_torch/filter.py:60
↓ 1 callers
Class
NLayerDiscriminator1dFeats
Defines a PatchGAN discriminator as in Pix2Pix --> see https://github.com/junyanz/pytorch-CycleGAN-and-pix2pix/blob/master/models/networks.py
ldm/modules/discriminator/model.py:149
↓ 1 callers
Class
QKVAttentionLegacy
A module which performs QKV attention. Matches legacy QKVAttention + input/ouput heads shaping
ldm/modules/diffusionmodules/openaimodel.py:347
↓ 1 callers
Class
Residual
ldm/modules/x_transformer.py:163
↓ 1 callers
Class
Scale
ldm/modules/x_transformer.py:117
↓ 1 callers
Class
TextEncoder
wav_evaluation/models/clap.py:42
↓ 1 callers
Class
UpSample1d
vocoder/bigvgan/alias_free_torch/resample.py:10
↓ 1 callers
Class
WrappedDataset
Wraps an arbitrary object with __len__ and __getitem__ into a pytorch dataset
main.py:158
↓ 1 callers
Class
tsv_dataset
preprocess/mel_spec.py:22
Class
AMPBlock1
vocoder/bigvgan/models.py:30
Class
AMPBlock2
vocoder/bigvgan/models.py:90
Class
AbstractDistribution
ldm/modules/distributions/distributions.py:5
Class
AbstractEncoder
ldm/modules/encoders/modules.py:14
Class
ActNorm
ldm/modules/discriminator/model.py:5
Class
AttBlock
wav_evaluation/models/audio.py:82
Class
AttBlock
ldm/modules/encoders/CLAP/audio.py:82
Class
AttentionLayers
ldm/modules/x_transformer.py:370
Class
AudioLogger
main.py:409
Class
AutoencoderKL
ldm/models/autoencoder.py:305
Class
AutoencoderKL
ldm/models/autoencoder_multi.py:23
Class
BERTEmbedder
Uses the BERT tokenizr model and add some transformer encoder layers
ldm/modules/encoders/modules.py:81
Class
CUDACallback
main.py:489
Class
CheckpointFunction
ldm/modules/diffusionmodules/util.py:119
Class
ClassEmbedder
ldm/modules/encoders/modules.py:22
Class
Cnn14
wav_evaluation/models/audio.py:107
Class
Cnn14
ldm/modules/encoders/CLAP/audio.py:107
Class
ConvBlock5x5
wav_evaluation/models/audio.py:51
Class
ConvBlock5x5
ldm/modules/encoders/CLAP/audio.py:51
Class
DDPM
ldm/models/diffusion/ddpm.py:43
Class
DataModuleFromConfig
main.py:180
Class
DiracDistribution
ldm/modules/distributions/distributions.py:13
Class
Discriminator
ldm/modules/discriminator/multi_window_disc.py:151
Class
DummyLoss
ldm/modules/losses_audio/vqperceptual.py:45
Class
EncoderUNetModel
The half UNet model with attention and timestep embedding. For usage, see UNet.
ldm/modules/diffusionmodules/openaimodel.py:747
Class
FirstStagePostProcessor
ldm/modules/diffusionmodules/model.py:770
Class
FrozenCLAPEmbedder
Uses the CLAP transformer encoder for text (from huggingface)
ldm/modules/encoders/modules.py:173
Class
FrozenCLAPEmbedderNoLoad
ldm/modules/encoders/modules.py:214
Class
FrozenFLANEmbedder
Uses the T5 transformer encoder for text
ldm/modules/encoders/modules.py:247
Class
FrozenT5Embedder
Uses the T5 transformer encoder for text
ldm/modules/encoders/modules.py:143
Class
HybridConditioner
ldm/modules/diffusionmodules/util.py:251
Class
IdentityFirstStage
ldm/models/autoencoder.py:457
Class
IdentityFirstStage
ldm/models/autoencoder_multi.py:184
Class
ImageLogger
main.py:313
next →
1–100 of 143, ranked by callers