MCPcopy Create free account

hub / github.com/Text-to-Audio/Make-An-Audio / functions

Functions679 in github.com/Text-to-Audio/Make-An-Audio

↓ 132 callersMethodto
(self,device,**kwagrs)
preprocess/NAT_mel.py:58
↓ 45 callersMethodregister_buffer
(self, name, attr)
ldm/models/diffusion/ddim.py:20
↓ 32 callersFunctioninstantiate_from_config
(config,reload=False)
ldm/util.py:111
↓ 29 callersMethoddecode
(self, x_latent, cond, t_start, unconditional_guidance_scale=1.0, unconditional_conditioning=None,
ldm/models/diffusion/ddim.py:244
↓ 27 callersMethodq_sample
(self, x_start, t, noise=None)
ldm/models/diffusion/ddpm.py:272
↓ 19 callersMethodema_scope
(self, context=None)
ldm/models/diffusion/ddpm.py:170
↓ 19 callersFunctionextract_into_tensor
(a, t, x_shape)
ldm/modules/diffusionmodules/util.py:96
↓ 18 callersFunctionconv_nd
Create a 1D, 2D, or 3D convolution module.
ldm/modules/diffusionmodules/util.py:218
↓ 16 callersFunctionexists
(val)
ldm/modules/x_transformer.py:54
↓ 15 callersMethod__init__
(self, *, ch, out_ch, ch_mult=(1,2,4,8), num_res_blocks, attn_resolutions, dropout=0.0, resa
ldm/modules/diffusionmodules/model.py:217
↓ 13 callersMethodregister_buffer
(self, name, attr)
ldm/models/diffusion/plms.py:18
↓ 12 callersMethod__init__
(self, value, fn)
ldm/modules/x_transformer.py:118
↓ 12 callersMethoddecode_first_stage
(self, z, predict_cids=False, force_not_quantize=False)
ldm/models/diffusion/ddpm_audio.py:356
↓ 12 callersFunctionget_padding
(kernel_size, dilation=1)
vocoder/bigvgan/models.py:27
↓ 11 callersMethodencode
(self, x)
ldm/models/autoencoder.py:96
↓ 10 callersMethoddecode_first_stage
(self, z, predict_cids=False, force_not_quantize=False)
ldm/models/diffusion/ddpm.py:704
↓ 10 callersMethodget_learned_conditioning
(self, c)
ldm/models/diffusion/ddpm.py:549
↓ 10 callersFunctionnonlinearity
(x)
ldm/modules/diffusionmodules/model.py:33
↓ 10 callersFunctionnormalization
Make a standard normalization layer. :param channels: number of input channels. :return: an nn.Module for normalization.
ldm/modules/diffusionmodules/util.py:199
↓ 9 callersFunctionNormalize
(in_channels, num_groups=32)
ldm/modules/diffusionmodules/model.py:38
↓ 9 callersMethod__init__
(self, channels, use_conv, dims=2, out_channels=None, padding=1)
ldm/modules/diffusionmodules/openaimodel.py:100
↓ 9 callersMethod__init__
(self, n_embed, n_layer, vocab_size=30522, max_seq_len=77, device="cuda",use_tokenizer=True,
ldm/modules/encoders/modules.py:83
↓ 9 callersMethodclip
Ramdom clip x to win_length. Args: x (tensor) : (B, c_in, T, n_bins). cond (tensor) : (B, T, H). x_len (te
ldm/modules/discriminator/multi_window_disc.py:124
↓ 9 callersFunctiondefault
(val, d)
ldm/util.py:90
↓ 9 callersFunctionexists
(x)
ldm/util.py:86
↓ 8 callersMethoddecode_first_stage
(self, z, predict_cids=False, force_not_quantize=False)
ldm/models/diffusion/ddpm_audio_inpaint.py:348
↓ 8 callersFunctionlinear
Create a linear module.
ldm/modules/diffusionmodules/util.py:231
↓ 8 callersFunctionlog_txt_as_img
(wh, xc, size=10)
ldm/util.py:50
↓ 8 callersMethodsample
(self, batch_size=16, return_intermediates=False)
ldm/models/diffusion/ddpm.py:266
↓ 7 callersMethodget_learned_conditioning
(self, c)
ldm/models/diffusion/ddpm_audio.py:170
↓ 7 callersMethodget_learned_conditioning
(self, c)
ldm/models/diffusion/ddpm_audio_inpaint.py:170
↓ 7 callersMethodget_loss
(self, pred, target, mean=True)
ldm/models/diffusion/ddpm.py:277
↓ 7 callersFunctionmake_attn
(in_channels, attn_type="vanilla")
ldm/modules/diffusionmodules/model.py:205
↓ 7 callersMethodquantize
(self, x, *args, **kwargs)
ldm/models/autoencoder.py:468
↓ 6 callersMethod__init__
(self, dim_in, dim_out)
ldm/modules/attention.py:38
↓ 6 callersMethod__init__
(self, h)
vocoder/bigvgan/models.py:135
↓ 6 callersMethodapply_model
(self, x_noisy, t, cond, return_ids=False)
ldm/models/diffusion/ddpm.py:856
↓ 6 callersFunctiondefault
(val, d)
ldm/modules/x_transformer.py:58
↓ 6 callersMethodmode
(self)
ldm/modules/distributions/distributions.py:20
↓ 6 callersFunctionnoise_like
(shape, device, repeat=False)
ldm/modules/diffusionmodules/util.py:264
↓ 6 callersMethodsample_log
(self,cond,batch_size,ddim, ddim_steps,**kwargs)
ldm/models/diffusion/ddpm_audio.py:701
↓ 6 callersMethodvocode
(self, spec)
vocoder/bigvgan/models.py:406
↓ 5 callersMethodget_input
(self, batch, k, return_first_stage_outputs=False, force_c_encode=False, cond_key=None, ret
ldm/models/diffusion/ddpm_audio.py:299
↓ 5 callersMethodget_input
(self, batch, k)
ldm/models/diffusion/ddpm.py:327
↓ 5 callersMethodget_input
(self, batch, k, return_first_stage_outputs=False, force_c_encode=False, cond_key=None, ret
ldm/models/diffusion/ddpm_audio_inpaint.py:273
↓ 5 callersFunctionzero_module
Zero out the parameters of a module and return it.
ldm/modules/diffusionmodules/util.py:174
↓ 4 callersMethod__init__
(self, batch_frequency, max_images, increase_log_steps=True, disabled=False, log_on_batch_idx
main.py:314
↓ 4 callersFunctionadopt_weight
(weight, global_step, threshold=0, value=0.)
ldm/modules/losses_audio/vqperceptual.py:21
↓ 4 callersMethodcompute_top_k
(self, logits, labels, k, reduction="mean")
ldm/models/diffusion/classifier.py:150
↓ 4 callersMethodencode_first_stage
(self, x)
ldm/models/diffusion/ddpm_audio_inpaint.py:468
↓ 4 callersMethodget_first_stage_encoding
(self, encoder_posterior)
ldm/models/diffusion/ddpm_audio_inpaint.py:161
↓ 4 callersMethodget_fold_unfold
:param x: img of size (bs, c, h, w) :return: n img crops of size (n, bs, c, kernel_size[0], kernel_size[1])
ldm/models/diffusion/ddpm.py:599
↓ 4 callersMethodget_fold_unfold
:param x: img of size (bs, c, h, w) :return: n img crops of size (n, bs, c, kernel_size[0], kernel_size[1])
ldm/models/diffusion/ddpm_audio_inpaint.py:220
↓ 4 callersMethodget_input
(self, batch, k)
ldm/models/autoencoder.py:124
↓ 4 callersMethodget_input
(self, batch, k)
ldm/models/autoencoder_multi.py:82
↓ 4 callersMethodget_last_layer
(self)
ldm/models/autoencoder.py:250
↓ 4 callersMethodget_last_layer
(self)
ldm/models/autoencoder_multi.py:155
↓ 4 callersMethodget_text_embeddings
r"""Load list of class labels and return text embeddings
wav_evaluation/models/CLAPWrapper.py:174
↓ 4 callersFunctionisimage
(x)
ldm/util.py:80
↓ 4 callersFunctionismap
(x)
ldm/util.py:74
↓ 4 callersMethodpredict_start_from_noise
(self, x_t, t, noise)
ldm/models/diffusion/ddpm.py:214
↓ 4 callersMethodq_posterior
(self, x_start, x_t, t)
ldm/models/diffusion/ddpm.py:220
↓ 4 callersMethodsample_log
(self,cond,batch_size,ddim, ddim_steps,**kwargs)
ldm/models/diffusion/ddpm.py:1198
↓ 4 callersMethodsample_log
(self,cond,batch_size,ddim, ddim_steps,**kwargs)
ldm/models/diffusion/ddpm_audio_inpaint.py:923
↓ 4 callersMethodshared_step
(self, batch, t=None)
ldm/models/diffusion/classifier.py:179
↓ 4 callersMethodto_rgb
(self, x)
ldm/models/diffusion/ddpm.py:1349
↓ 3 callersMethod__init__
(self, sample_rate, window_size, hop_size, mel_bins, fmin, fmax, classes_num, out_emb)
wav_evaluation/models/audio.py:108
↓ 3 callersMethod__init__
(self, # audio audioenc_name: str, sample_rate: int,
wav_evaluation/models/clap.py:56
↓ 3 callersMethod__init__
(self, num_features, logdet=False, affine=True, allow_reverse_init=False)
ldm/modules/discriminator/model.py:6
↓ 3 callersMethod__init__
(self, sample_rate, window_size, hop_size, mel_bins, fmin, fmax, classes_num, out_emb)
ldm/modules/encoders/CLAP/audio.py:108
↓ 3 callersMethod__init__
(self, # audio audioenc_name: str, sample_rate: int,
ldm/modules/encoders/CLAP/clap.py:55
↓ 3 callersMethod__init__
(self, specs_dataset_cfg)
ldm/data/joinaudiodataset_624.py:88
↓ 3 callersMethod__init__
(self, ddconfig, lossconfig, n_embed, embe
ldm/models/autoencoder.py:15
↓ 3 callersMethod__init__
(self, unet_config, timesteps=1000, beta_schedule="linea
ldm/models/diffusion/ddpm.py:45
↓ 3 callersMethod_generic_batch_inference
r"""Process audio and/or text per batch
wav_evaluation/models/CLAPWrapper.py:220
↓ 3 callersMethod_generic_batch_inference
r"""Process audio and/or text per batch
ldm/modules/encoders/CLAP/CLAPWrapper.py:204
↓ 3 callersMethod_get_denoise_row_from_list
(self, samples, desc='', force_no_decoder_quantization=False)
ldm/models/diffusion/ddpm_audio.py:146
↓ 3 callersFunctioncheckpoint
Evaluate a function without caching intermediate activations, allowing for reduced memory at the expense of extra compute in the backward p
ldm/modules/diffusionmodules/util.py:102
↓ 3 callersMethodcompute_similarity
r"""Compute similarity between text and audio embeddings
wav_evaluation/models/CLAPWrapper.py:205
↓ 3 callersFunctioncount_params
(model, verbose=False)
ldm/util.py:104
↓ 3 callersFunctiondefault
(val, d)
ldm/modules/attention.py:19
↓ 3 callersMethodema_scope
(self, context=None)
ldm/models/autoencoder.py:64
↓ 3 callersMethodencode_first_stage
(self, x)
ldm/models/diffusion/ddpm_audio.py:388
↓ 3 callersMethodencode_first_stage
(self, x)
ldm/models/diffusion/ddpm.py:801
↓ 3 callersMethodget_audio_embeddings
r"""Load list of audio files and return a audio embeddings
wav_evaluation/models/CLAPWrapper.py:181
↓ 3 callersMethodget_first_stage_encoding
(self, encoder_posterior)
ldm/models/diffusion/ddpm_audio.py:160
↓ 3 callersMethodget_first_stage_encoding
(self, encoder_posterior)
ldm/models/diffusion/ddpm.py:540
↓ 3 callersMethodget_input
(self, batch, k)
ldm/models/autoencoder.py:365
↓ 3 callersMethodget_weighting
(self, h, w, Ly, Lx, device)
ldm/models/diffusion/ddpm_audio.py:230
↓ 3 callersMethodget_weighting
(self, h, w, Ly, Lx, device)
ldm/models/diffusion/ddpm.py:583
↓ 3 callersMethodget_weighting
(self, h, w, Ly, Lx, device)
ldm/models/diffusion/ddpm_audio_inpaint.py:204
↓ 3 callersMethodinit_from_ckpt
(self, path, ignore_keys=list(), only_model=False)
ldm/models/diffusion/ddpm.py:184
↓ 3 callersFunctionmean_flat
Take the mean over all non-batch dimensions.
ldm/modules/diffusionmodules/util.py:192
↓ 3 callersFunctionnormal_kl
source: https://github.com/openai/guided-diffusion/blob/27c20a8fab9cb472df5d6bdd6c8d11c8f430b924/guided_diffusion/losses.py#L12 Compute the
ldm/modules/distributions/distributions.py:65
↓ 3 callersMethodq_mean_variance
Get the distribution q(x_t | x_0). :param x_start: the [N x C x ...] tensor of noiseless inputs. :param t: the number of d
ldm/models/diffusion/ddpm.py:202
↓ 3 callersMethodsample
(self, cond, batch_size=16, return_intermediates=False, x_T=None, verbose=True, timesteps=None
ldm/models/diffusion/ddpm_audio.py:680
↓ 3 callersMethodsample
(self, S, batch_size, shape, conditioning=None
ldm/models/diffusion/ddim.py:59
↓ 3 callersMethodsample
(self, cond, batch_size=16, return_intermediates=False, x_T=None, verbose=True, timesteps=None
ldm/models/diffusion/ddpm_audio_inpaint.py:905
↓ 3 callersMethodshared_step
(self, batch)
ldm/models/diffusion/ddpm.py:335
↓ 3 callersFunctiontimestep_embedding
Create sinusoidal timestep embeddings. :param timesteps: a 1-D Tensor of N indices, one per batch element. These may
ldm/modules/diffusionmodules/util.py:151
next →1–100 of 679, ranked by callers