MCPcopy Create free account

hub / github.com/Text-to-Audio/Make-An-Audio / types & classes

Types & classes143 in github.com/Text-to-Audio/Make-An-Audio

↓ 17 callersClassResnetBlock
ldm/modules/diffusionmodules/model.py:82
↓ 16 callersClassResBlock
A residual block that can optionally change the number of channels. :param channels: the number of input channels. :param emb_channels
ldm/modules/diffusionmodules/openaimodel.py:163
↓ 14 callersClassTimestepEmbedSequential
A sequential module that passes timestep embeddings to the children that support it as an extra input.
ldm/modules/diffusionmodules/openaimodel.py:74
↓ 8 callersClassAttentionBlock
An attention block that allows spatial positions to attend to each other. Originally ported from here, but adapted to the N-d case. ht
ldm/modules/diffusionmodules/openaimodel.py:278
↓ 6 callersClassActivation1d
vocoder/bigvgan/alias_free_torch/act.py:8
↓ 6 callersClassConvBlock
wav_evaluation/models/audio.py:13
↓ 6 callersClassConvBlock
ldm/modules/encoders/CLAP/audio.py:13
↓ 6 callersClassDDIMSampler
ldm/models/diffusion/ddim.py:12
↓ 6 callersClassSpatialTransformer
Transformer block for image-like data. First, project the input (aka embedding) and reshape to b, t, d. Then apply standard trans
ldm/modules/attention.py:218
↓ 5 callersClassDecoder
ldm/modules/diffusionmodules/model.py:462
↓ 5 callersClassDownsample
A downsampling layer with an optional convolution. :param channels: channels in the inputs and outputs. :param use_conv: a bool determ
ldm/modules/diffusionmodules/openaimodel.py:134
↓ 4 callersClassEncoder
ldm/modules/diffusionmodules/model.py:368
↓ 4 callersClassNLayerDiscriminator
Defines a PatchGAN discriminator as in Pix2Pix --> see https://github.com/junyanz/pytorch-CycleGAN-and-pix2pix/blob/master/models/networks.py
ldm/modules/discriminator/model.py:98
↓ 4 callersClassUpsample
An upsampling layer with an optional convolution. :param channels: channels in the inputs and outputs. :param use_conv: a bool determi
ldm/modules/diffusionmodules/openaimodel.py:91
↓ 4 callersClassUpsample
ldm/modules/diffusionmodules/model.py:42
↓ 3 callersClassDownsample
ldm/modules/diffusionmodules/model.py:60
↓ 3 callersClassLatentRescaler
ldm/modules/diffusionmodules/model.py:655
↓ 3 callersClassSnake
Implementation of a sine-based periodic activation function Shape: - Input: (B, C, T) - Output: (B, C, T), same shape as the
vocoder/bigvgan/activations.py:9
↓ 3 callersClassSnakeBeta
A modified Snake function which uses separate parameters for the magnitude of the periodic components Shape: - Input: (B, C, T)
vocoder/bigvgan/activations.py:62
↓ 3 callersClassTextEncoder
ldm/modules/encoders/CLAP/clap.py:42
↓ 3 callersClassVocoderBigVGAN
vocoder/bigvgan/models.py:393
↓ 2 callersClassAttention
ldm/modules/x_transformer.py:215
↓ 2 callersClassAttnBlock
ldm/modules/diffusionmodules/model.py:150
↓ 2 callersClassCrossAttention
ldm/modules/attention.py:152
↓ 2 callersClassDiagonalGaussianDistribution
ldm/modules/distributions/distributions.py:24
↓ 2 callersClassEncoder
ldm/modules/x_transformer.py:541
↓ 2 callersClassLitEma
ldm/modules/ema.py:5
↓ 2 callersClassMelNet
preprocess/NAT_mel.py:42
↓ 2 callersClassMultiWindowDiscriminator
ldm/modules/discriminator/multi_window_disc.py:66
↓ 2 callersClassProjection
wav_evaluation/models/clap.py:8
↓ 2 callersClassProjection
ldm/modules/encoders/CLAP/clap.py:8
↓ 2 callersClassQKVAttention
A module which performs QKV attention and splits in a different order.
ldm/modules/diffusionmodules/openaimodel.py:379
↓ 2 callersClassTransformerWrapper
ldm/modules/x_transformer.py:548
↓ 1 callersClassAbsolutePositionalEmbedding
ldm/modules/x_transformer.py:25
↓ 1 callersClassAttentionPool2d
Adapted from CLIP: https://github.com/openai/CLIP/blob/main/clip/model.py
ldm/modules/diffusionmodules/openaimodel.py:32
↓ 1 callersClassAudioEncoder
wav_evaluation/models/clap.py:22
↓ 1 callersClassAudioEncoder
ldm/modules/encoders/CLAP/clap.py:22
↓ 1 callersClassBERTTokenizer
Uses a pretrained BERT tokenizer by huggingface. Vocab size: 30522 (?)
ldm/modules/encoders/modules.py:54
↓ 1 callersClassBasicTransformerBlock
ldm/modules/attention.py:196
↓ 1 callersClassBigVGAN
vocoder/bigvgan/models.py:133
↓ 1 callersClassCLAP
wav_evaluation/models/clap.py:55
↓ 1 callersClassCLAP
ldm/modules/encoders/CLAP/clap.py:54
↓ 1 callersClassCLAPWrapper
A class for interfacing CLAP model.
wav_evaluation/models/CLAPWrapper.py:16
↓ 1 callersClassCLAPWrapper
A class for interfacing CLAP model.
ldm/modules/encoders/CLAP/CLAPWrapper.py:18
↓ 1 callersClassDiffusionWrapper
ldm/models/diffusion/ddpm.py:1358
↓ 1 callersClassDiscriminator2DFactory
ldm/modules/discriminator/multi_window_disc.py:6
↓ 1 callersClassDiscriminatorP
vocoder/bigvgan/models.py:216
↓ 1 callersClassDiscriminatorR
vocoder/bigvgan/models.py:277
↓ 1 callersClassDownSample1d
vocoder/bigvgan/alias_free_torch/resample.py:36
↓ 1 callersClassFeedForward
ldm/modules/x_transformer.py:194
↓ 1 callersClassFeedForward
ldm/modules/attention.py:47
↓ 1 callersClassFixedPositionalEmbedding
ldm/modules/x_transformer.py:39
↓ 1 callersClassGEGLU
ldm/modules/x_transformer.py:184
↓ 1 callersClassGEGLU
ldm/modules/attention.py:37
↓ 1 callersClassGRUGating
ldm/modules/x_transformer.py:168
↓ 1 callersClassGroupNorm32
ldm/modules/diffusionmodules/util.py:214
↓ 1 callersClassLinAttnBlock
to match AttnBlock usage
ldm/modules/diffusionmodules/model.py:144
↓ 1 callersClassLowPassFilter1d
vocoder/bigvgan/alias_free_torch/filter.py:60
↓ 1 callersClassNLayerDiscriminator1dFeats
Defines a PatchGAN discriminator as in Pix2Pix --> see https://github.com/junyanz/pytorch-CycleGAN-and-pix2pix/blob/master/models/networks.py
ldm/modules/discriminator/model.py:149
↓ 1 callersClassQKVAttentionLegacy
A module which performs QKV attention. Matches legacy QKVAttention + input/ouput heads shaping
ldm/modules/diffusionmodules/openaimodel.py:347
↓ 1 callersClassResidual
ldm/modules/x_transformer.py:163
↓ 1 callersClassScale
ldm/modules/x_transformer.py:117
↓ 1 callersClassTextEncoder
wav_evaluation/models/clap.py:42
↓ 1 callersClassUpSample1d
vocoder/bigvgan/alias_free_torch/resample.py:10
↓ 1 callersClassWrappedDataset
Wraps an arbitrary object with __len__ and __getitem__ into a pytorch dataset
main.py:158
↓ 1 callersClasstsv_dataset
preprocess/mel_spec.py:22
ClassAMPBlock1
vocoder/bigvgan/models.py:30
ClassAMPBlock2
vocoder/bigvgan/models.py:90
ClassAbstractDistribution
ldm/modules/distributions/distributions.py:5
ClassAbstractEncoder
ldm/modules/encoders/modules.py:14
ClassActNorm
ldm/modules/discriminator/model.py:5
ClassAttBlock
wav_evaluation/models/audio.py:82
ClassAttBlock
ldm/modules/encoders/CLAP/audio.py:82
ClassAttentionLayers
ldm/modules/x_transformer.py:370
ClassAudioLogger
main.py:409
ClassAutoencoderKL
ldm/models/autoencoder.py:305
ClassAutoencoderKL
ldm/models/autoencoder_multi.py:23
ClassBERTEmbedder
Uses the BERT tokenizr model and add some transformer encoder layers
ldm/modules/encoders/modules.py:81
ClassCUDACallback
main.py:489
ClassCheckpointFunction
ldm/modules/diffusionmodules/util.py:119
ClassClassEmbedder
ldm/modules/encoders/modules.py:22
ClassCnn14
wav_evaluation/models/audio.py:107
ClassCnn14
ldm/modules/encoders/CLAP/audio.py:107
ClassConvBlock5x5
wav_evaluation/models/audio.py:51
ClassConvBlock5x5
ldm/modules/encoders/CLAP/audio.py:51
ClassDDPM
ldm/models/diffusion/ddpm.py:43
ClassDataModuleFromConfig
main.py:180
ClassDiracDistribution
ldm/modules/distributions/distributions.py:13
ClassDiscriminator
ldm/modules/discriminator/multi_window_disc.py:151
ClassDummyLoss
ldm/modules/losses_audio/vqperceptual.py:45
ClassEncoderUNetModel
The half UNet model with attention and timestep embedding. For usage, see UNet.
ldm/modules/diffusionmodules/openaimodel.py:747
ClassFirstStagePostProcessor
ldm/modules/diffusionmodules/model.py:770
ClassFrozenCLAPEmbedder
Uses the CLAP transformer encoder for text (from huggingface)
ldm/modules/encoders/modules.py:173
ClassFrozenCLAPEmbedderNoLoad
ldm/modules/encoders/modules.py:214
ClassFrozenFLANEmbedder
Uses the T5 transformer encoder for text
ldm/modules/encoders/modules.py:247
ClassFrozenT5Embedder
Uses the T5 transformer encoder for text
ldm/modules/encoders/modules.py:143
ClassHybridConditioner
ldm/modules/diffusionmodules/util.py:251
ClassIdentityFirstStage
ldm/models/autoencoder.py:457
ClassIdentityFirstStage
ldm/models/autoencoder_multi.py:184
ClassImageLogger
main.py:313
next →1–100 of 143, ranked by callers