↓ 127 callersFunction_load_metrics(filename, sample_rate, window_size, hop_size, mel_bins, fmin,
fmax, data_type, model_type, loss_typ
audio_detection/audio_infer/utils/plot_statistics.py:120
↓ 43 callersMethodclipRamdom clip x to win_length. Args: x (tensor) : (B, c_in, T, n_bins). cond (tensor) : (B, T, H). x_len (te
text_to_audio/Make_An_Audio/ldm/modules/discriminator/multi_window_disc.py:124
↓ 42 callersMethoddecode(self, x_latent, cond, t_start, unconditional_guidance_scale=1.0, unconditional_conditioning=None,
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddim.py:244
↓ 27 callersFunction_load_metrics0(filename, sample_rate, window_size, hop_size, mel_bins, fmin,
fmax, data_type, model_type, loss_type, b
audio_detection/audio_infer/utils/plot_statistics.py:17
↓ 15 callersMethod__init__(self, *, ch, out_ch, ch_mult=(1,2,4,8), num_res_blocks,
attn_resolutions, dropout=0.0, resam
text_to_audio/Make_An_Audio/ldm/modules/diffusionmodules/model.py:217
↓ 13 callersMethod__init__(self, sample_rate, window_size, hop_size, mel_bins, fmin,
fmax, classes_num)
audio_detection/audio_infer/pytorch/models.py:142
↓ 13 callersFunction_load_metrics_classwise(filename, sample_rate, window_size, hop_size, mel_bins, fmin,
fmax, data_type, model_type, loss_type, b
audio_detection/audio_infer/utils/plot_statistics.py:76
↓ 12 callersMethod__init__(self, emb_dim, vocab_size, fc_emb_dim, attn_emb_dim,
dropout, d_model, **kwargs)
audio_to_text/captioning/models/decoder.py:48
↓ 12 callersMethod__init__(self, in_channels, out_channels, kernel_size, activation, momentum)
sound_extraction/model/modules.py:8
↓ 11 callersMethod__init__(self, n_embed, n_layer, vocab_size=30522, max_seq_len=77,
device="cuda",use_tokenizer=True,
text_to_audio/Make_An_Audio/ldm/modules/encoders/modules.py:83
↓ 11 callersMethodclipRamdom clip x to win_length. Args: x (tensor) : (B, c_in, T, n_bins). cond (tensor) : (B, T, H). x_len (te
NeuralSeq/modules/syntaspeech/multi_window_disc.py:81
↓ 10 callersMethod__init__(self, in_channels, out_channels, filter_channels, kernel_size, p_dropout=0., activation=None)
NeuralSeq/modules/commons/rel_transformer.py:241
↓ 9 callersMethod__init__(self, hidden_size, num_layers, ffn_kernel_size=9, dropout=0.0,
num_heads=2, use_pos_embed=Tr
NeuralSeq/modules/commons/transformer.py:653
↓ 9 callersMethod__init__(self, channels, use_conv, dims=2, out_channels=None, padding=1)
text_to_audio/Make_An_Audio/ldm/modules/diffusionmodules/openaimodel.py:100
↓ 8 callersMethodload_ckpt(self, ckpt_base_dir, current_model_name=None, model_name='model', force=True, strict=True)
NeuralSeq/tasks/base_task.py:109
↓ 7 callersMethod__init__(self, h, channels, kernel_size=3, dilation=(1, 3, 5))
NeuralSeq/modules/hifigan/hifigan.py:31
↓ 7 callersMethod__init__(self, in_features, hidden_features=None, out_features=None, act_layer=nn.GELU, drop=0.)
text_to_audio/Make_An_Audio/ldm/modules/encoders/open_clap/htsat.py:149