MCPcopy Create free account

hub / github.com/AIGC-Audio/AudioGPT / functions

Functions2,752 in github.com/AIGC-Audio/AudioGPT

↓ 1 callersMethodload_clap
r"""Load CLAP model with args from config file
text_to_audio/Make_An_Audio/ldm/modules/encoders/CLAP/CLAPWrapper.py:34
↓ 1 callersMethodload_classifier
(self, ckpt_path, pool)
text_to_audio/Make_An_Audio/ldm/models/diffusion/classifier.py:95
↓ 1 callersFunctionload_config
(config_fn)
NeuralSeq/utils/hparams.py:49
↓ 1 callersFunctionload_config
(config_file)
audio_to_text/captioning/utils/train_util.py:69
↓ 1 callersMethodload_dict
(self, base_dir)
NeuralSeq/data_gen/tts/base_preprocess.py:243
↓ 1 callersMethodload_diffusion
(self)
text_to_audio/Make_An_Audio/ldm/models/diffusion/classifier.py:88
↓ 1 callersMethodload_from_pretrain
(self, pretrained_checkpoint_path)
audio_detection/audio_infer/pytorch/finetune_template.py:49
↓ 1 callersMethodload_from_pretrained
(self, name="vggishish_lpaps")
text_to_audio/Make_An_Audio/ldm/modules/losses_audio/lpaps.py:33
↓ 1 callersFunctionload_json
(name)
text_to_audio/Make_An_Audio/ldm/modules/encoders/open_clap/utils.py:316
↓ 1 callersMethodload_mel_inputs
(self, test_input_dir, spk_id=0)
NeuralSeq/tasks/vocoder/dataset_utils.py:186
↓ 1 callersMethodload_meta_data
(self)
NeuralSeq/data_gen/tts/base_binarizer_emotion.py:42
↓ 1 callersFunctionload_model
(config, checkpoint)
audio_to_text/inference_waveform.py:12
↓ 1 callersFunctionload_openai_model
Load a CLIP model, preserve its text pretrained part, and set in the CLAP model Parameters ---------- name : str A model name lis
text_to_audio/Make_An_Audio/ldm/modules/encoders/open_clap/openai.py:23
↓ 1 callersFunctionload_p
(filename)
text_to_audio/Make_An_Audio/ldm/modules/encoders/open_clap/utils.py:301
↓ 1 callersMethodload_spk_map
(self, base_dir)
NeuralSeq/data_gen/tts/base_preprocess.py:238
↓ 1 callersMethodload_state_dict
(self, resume_iteration)
audio_detection/audio_infer/utils/utilities.py:162
↓ 1 callersMethodload_test_inputs
(self, test_input_dir)
NeuralSeq/modules/GenerSpeech/task/dataset.py:55
↓ 1 callersMethodload_test_inputs
(self, test_input_dir, spk_id=0)
NeuralSeq/tasks/tts/fs2_utils.py:154
↓ 1 callersMethodload_test_inputs
(self)
NeuralSeq/tasks/tts/dataset_utils.py:212
↓ 1 callersMethodload_test_inputs
(self, test_input_dir, spk_id=0)
NeuralSeq/tasks/vocoder/dataset_utils.py:167
↓ 1 callersFunctionload_wav
(path)
sound_extraction/utils/wav_io.py:7
↓ 1 callersMethodload_word_embedding
(self, weight, freeze=True)
audio_to_text/captioning/models/decoder.py:33
↓ 1 callersMethodlog_images
(self, batch, N=8, n_row=4, sample=True, ddim_steps=200, ddim_eta=1., return_keys=None, qua
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm_audio.py:921
↓ 1 callersMethodlog_images
(self, batch, N=8, n_row=2, sample=True, return_keys=None, **kwargs)
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm.py:376
↓ 1 callersMethodlr_lambda
(self, iteration)
audio_to_text/captioning/utils/lr_scheduler.py:81
↓ 1 callersFunctionmain
(checkpoint)
audio_to_text/captioning/utils/remove_optimizer.py:5
↓ 1 callersMethodmake_batch_sd
(self, mel, mask, num_samples=1)
audio-chatgpt.py:436
↓ 1 callersFunctionmake_beta_schedule
(schedule, n_timestep, linear_start=1e-4, linear_end=2e-2, cosine_s=8e-3)
text_to_audio/Make_An_Audio/ldm/modules/diffusionmodules/util.py:21
↓ 1 callersMethodmake_cond_schedule
(self, )
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm_audio.py:86
↓ 1 callersMethodmake_cond_schedule
(self, )
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm.py:469
↓ 1 callersMethodmake_cond_schedule
(self, )
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm_audio_inpaint.py:90
↓ 1 callersFunctionmake_pad_mask
Make mask tensor containing indices of padded part. Args: lengths (LongTensor or List): Batch of lengths (B,). xs (Tensor, optiona
NeuralSeq/utils/tts_utils.py:164
↓ 1 callersFunctionmake_positions
Replace non-padding symbols with their position numbers. Position numbers begin at padding_idx+1. Padding symbols are ignored.
NeuralSeq/utils/tts_utils.py:6
↓ 1 callersMethodmake_schedule
(self, ddim_num_steps, ddim_discretize="uniform", ddim_eta=0., verbose=True)
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddim.py:27
↓ 1 callersMethodmake_schedule
(self, ddim_num_steps, ddim_discretize="uniform", ddim_eta=0., verbose=True)
text_to_audio/Make_An_Audio/ldm/models/diffusion/plms.py:24
↓ 1 callersMethodmake_split_files
(self)
text_to_audio/Make_An_Audio/ldm/modules/losses_audio/vggishish/dataset.py:69
↓ 1 callersFunctionmax_neg_value
(tensor)
text_to_audio/Make_An_Audio/ldm/modules/x_transformer.py:82
↓ 1 callersFunctionmedian_filter
median_filter :param x: input prediction array of shape (B, T, C) or (B, T). Input is a sequence of probabilities 0 <= x <= 1 :param w
audio_detection/target_sound_detection/src/utils.py:189
↓ 1 callersFunctionmel2ph_to_mel2word
(mel2ph, ph2word)
NeuralSeq/modules/commons/align_ops.py:9
↓ 1 callersFunctionmerge_a_into_b
(a, b)
audio_to_text/captioning/utils/train_util.py:57
↓ 1 callersMethodmeshgrid
(self, h, w)
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm_audio.py:205
↓ 1 callersMethodmeshgrid
(self, h, w)
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm_audio_inpaint.py:183
↓ 1 callersMethodmeta_data
:return: {'item_name': Str, 'wav_fn': Str, 'txt': Str, 'spk_name': Str, 'txt_loader': None or Func}
NeuralSeq/data_gen/tts/base_preprocess.py:28
↓ 1 callersMethodmeta_data
(self, prefix)
NeuralSeq/data_gen/tts/base_binarizer.py:96
↓ 1 callersMethodmeta_data
(self, prefix)
NeuralSeq/data_gen/tts/base_binarizer_emotion.py:133
↓ 1 callersMethodmetrics_to_scalars
(self, metrics)
NeuralSeq/utils/pl_utils.py:945
↓ 1 callersMethodmoney2chntext
(self)
NeuralSeq/utils/text_norm.py:573
↓ 1 callersFunctionmoving_average
(array, width)
NeuralSeq/data_gen/tts/data_gen_utils.py:75
↓ 1 callersFunctionmoving_average
(array, width)
NeuralSeq/data_gen/tts/emotion/audio.py:85
↓ 1 callersMethodneural_warpfield
(self, view, seq_length)
mono2binaural/src/models.py:63
↓ 1 callersMethodnoise_decay
decayed_noise = noise_decay(beta, f0mean) decayed_noise = n[t]exp(-t * f_mean / beta / samp_rate) beta: (dim=1) or (batchsize=1, 1,
NeuralSeq/modules/parallel_wavegan/models/source.py:264
↓ 1 callersFunctionnoise_like
(shape, device, repeat=False)
NeuralSeq/modules/diff/diffusion.py:162
↓ 1 callersFunctionnoise_like
(shape, device, repeat=False)
NeuralSeq/modules/diff/shallow_diffusion_tts.py:38
↓ 1 callersMethodnonlinear_transform
(self, x)
text_to_audio/Make_An_Audio/wav_evaluation/models/audio.py:100
↓ 1 callersMethodnonlinear_transform
(self, x)
text_to_audio/Make_An_Audio/ldm/modules/encoders/open_clap/pann_model.py:139
↓ 1 callersMethodnonlinear_transform
(self, x)
text_to_audio/Make_An_Audio/ldm/modules/encoders/CLAP/audio.py:100
↓ 1 callersMethodnorm_spec
(self, x)
NeuralSeq/modules/diff/diffusion.py:324
↓ 1 callersFunctionnormalize_volume
(wav, target_dBFS, increase_only=False, decrease_only=False)
NeuralSeq/data_gen/tts/emotion/audio.py:101
↓ 1 callersFunctionnot_equals
(val)
text_to_audio/Make_An_Audio/ldm/modules/x_transformer.py:70
↓ 1 callersMethodon_after_backward
(self)
NeuralSeq/tasks/base_task.py:335
↓ 1 callersMethodon_batch_end
(self)
NeuralSeq/tasks/base_task.py:323
↓ 1 callersMethodon_batch_start
(self, batch)
NeuralSeq/tasks/base_task.py:320
↓ 1 callersMethodon_epoch_begin
(self, epoch, trainer)
NeuralSeq/utils/pl_utils.py:276
↓ 1 callersMethodon_epoch_start
(self)
NeuralSeq/tasks/base_task.py:115
↓ 1 callersMethodon_post_performance_check
(self)
NeuralSeq/tasks/base_task.py:329
↓ 1 callersMethodon_pre_performance_check
(self)
NeuralSeq/tasks/base_task.py:326
↓ 1 callersMethodon_sanity_check_start
(self)
NeuralSeq/tasks/base_task.py:311
↓ 1 callersMethodon_save_checkpoint
(self, checkpoint)
NeuralSeq/tasks/base_task.py:308
↓ 1 callersMethodon_train_end
(self)
NeuralSeq/tasks/base_task.py:317
↓ 1 callersMethodon_train_start
(self)
NeuralSeq/tasks/base_task.py:314
↓ 1 callersMethodoptimizer_step
(self, epoch, batch_idx, optimizer, optimizer_idx)
NeuralSeq/tasks/base_task.py:157
↓ 1 callersMethodorcal_EE
(self, x, embedding, label)
audio_detection/target_sound_detection/src/models.py:1188
↓ 1 callersMethodp_losses
(self, x_start, t, cond, noise=None, nonpadding=None)
NeuralSeq/modules/diff/diffusion.py:280
↓ 1 callersMethodp_losses
(self, x_start, cond, t, noise=None)
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm_audio.py:682
↓ 1 callersMethodp_losses
(self, x_start, t, noise=None)
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm.py:292
↓ 1 callersMethodp_losses
(self, x_start, cond, t, noise=None)
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm.py:1010
↓ 1 callersMethodp_losses
(self, x_start, cond, t, noise=None)
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm_audio_inpaint.py:700
↓ 1 callersMethodp_mean_variance
(self, x, t, cond, clip_denoised: bool)
NeuralSeq/modules/diff/diffusion.py:254
↓ 1 callersMethodp_mean_variance
(self, x, t, cond, clip_denoised: bool)
NeuralSeq/modules/diff/shallow_diffusion_tts.py:149
↓ 1 callersMethodp_mean_variance
(self, x, c, t, clip_denoised: bool, return_codebook_ids=False, quantize_denoised=False,
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm_audio.py:717
↓ 1 callersMethodp_mean_variance
(self, x, t, clip_denoised: bool)
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm.py:229
↓ 1 callersMethodp_mean_variance
(self, x, c, t, clip_denoised: bool, return_codebook_ids=False, quantize_denoised=False,
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm.py:1045
↓ 1 callersMethodp_mean_variance
(self, x, c, t, clip_denoised: bool, return_codebook_ids=False, quantize_denoised=False,
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm_audio_inpaint.py:735
↓ 1 callersMethodp_sample
(self, x, t, cond, clip_denoised=True, repeat_noise=False)
NeuralSeq/modules/diff/diffusion.py:265
↓ 1 callersMethodp_sample
(self, x, t, clip_denoised=True, repeat_noise=False)
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm.py:242
↓ 1 callersMethodp_sample_loop
(self, cond, shape, return_intermediates=False, x_T=None, verbose=True, callback=None, t
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm_audio.py:836
↓ 1 callersMethodp_sample_loop
(self, shape, return_intermediates=False)
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm.py:251
↓ 1 callersMethodp_sample_loop
(self, cond, shape, return_intermediates=False, x_T=None, verbose=True, callback=None, t
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm.py:1164
↓ 1 callersMethodp_sample_loop
(self, cond, shape, return_intermediates=False, x_T=None, verbose=True, callback=None, t
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm_audio_inpaint.py:854
↓ 1 callersMethodp_sample_plms
Use the PLMS method from [Pseudo Numerical Methods for Diffusion Models on Manifolds](https://arxiv.org/abs/2202.09778).
NeuralSeq/modules/diff/shallow_diffusion_tts.py:169
↓ 1 callersMethodp_sample_plms
(self, x, c, t, index, repeat_noise=False, use_original_steps=False, quantize_denoised=False,
text_to_audio/Make_An_Audio/ldm/models/diffusion/plms.py:173
↓ 1 callersFunctionpack_waveforms_to_hdf5
Pack waveform and target of several audio clips to a single hdf5 file. This can speed up loading and training.
audio_detection/audio_infer/utils/dataset.py:125
↓ 1 callersFunctionpad_or_truncate
Pad all audio to specific length.
audio_detection/audio_infer/utils/utilities.py:104
↓ 1 callersMethodparallel_apply
(self, replicas, inputs, kwargs)
NeuralSeq/utils/pl_utils.py:184
↓ 1 callersMethodparallel_apply
(self, replicas, inputs, kwargs)
NeuralSeq/utils/pl_utils.py:253
↓ 1 callersFunctionpatches_from_image
(img, p_size=512, p_overlap=64, p_max=800)
text_to_audio/Make_An_Audio/ldm/modules/image_degradation/utils_image.py:93
↓ 1 callersMethodpercentage2chntext
(self)
NeuralSeq/utils/text_norm.py:596
↓ 1 callersMethodplms_sampling
(self, cond, shape, x_T=None, ddim_use_original_steps=False, callb
text_to_audio/Make_An_Audio/ldm/models/diffusion/plms.py:115
↓ 1 callersFunctionplot
(args)
audio_detection/audio_infer/utils/plot_statistics.py:96
↓ 1 callersFunctionplot_class_iteration
(args)
audio_detection/audio_infer/utils/plot_statistics.py:1432
← previousnext →901–1,000 of 2,752, ranked by callers