↓ 2 callersFunctionget_avg_stats(workspace, bgn_iter, fin_iter, interval_iter, filename, data_type)
audio_detection/audio_infer/utils/plot_statistics.py:1524
↓ 2 callersMethodget_input(self, batch, k, return_first_stage_outputs=False, force_c_encode=False,
cond_key=None, retu
text_to_audio/Make_An_Audio/ldm/models/diffusion/ddpm.py:652
↓ 2 callersFunctiongroup_hidden_by_segs :param h: [B, T, H] :param seg_ids: [B, T] :return: h_ph: [B, T_ph, H]
NeuralSeq/modules/syntaspeech/syntactic_graph_encoder.py:16
↓ 2 callersFunctiongroup_hidden_by_segs :param h: [B, T, H] :param seg_ids: [B, T] :return: h_ph: [B, T_ph, H]
NeuralSeq/utils/tts_utils.py:357
↓ 2 callersFunctionimage_transform(
image_size: int,
is_train: bool,
mean=(0.48145466, 0.4578275, 0.40821073),
s
text_to_audio/Make_An_Audio/ldm/modules/encoders/open_clap/transform.py:9
↓ 2 callersMethodlog_best_model(self, model, loss, epoch, optimizer, metrics_dict)
text_to_audio/Make_An_Audio/ldm/modules/losses_audio/vggishish/logger.py:76