↓ 9 callersMethod__init__(
self,
out_channels,
kernel_size,
input_shape=None,
in_channels=None,
fireredtts/modules/semantic_tokenizer/ecapa_tdnn.py:124
↓ 2 callersFunctionpad1d(
x: torch.Tensor,
paddings: tp.Tuple[int, int],
mode: str = "zero",
value: float = 0.0,
)
fireredtts/modules/acoustic_codec/bigcodec.py:76
↓ 2 callersFunctionpad1d(
x: torch.Tensor,
paddings: tp.Tuple[int, int],
mode: str = "zero",
value: float = 0.0,
)
fireredtts/modules/semantic_tokenizer/semantic_tokenizer.py:102
↓ 1 callersMethodbuild_aligned_inputs_and_targets(
self, seqs, lens, start_token, stop_token, delay=0
)
fireredtts/modules/acoustic_llm/acoustic_llm.py:676
↓ 1 callersFunctionbuild_hf_gpt_transformer(
layers, model_dim, heads, max_mel_seq_len, max_text_seq_len, checkpointing
)
fireredtts/modules/acoustic_llm/acoustic_llm.py:507
↓ 1 callersMethodextract_speech_tokens(
self, wav, wav_length, serialize=True, extract_spk=True, shuffle=False
)
fireredtts/modules/acoustic_codec/bigcodec.py:667
↓ 1 callersMethodextract_speech_tokens(
self, wav, wav_length, serialize=True, extract_spk=True, shuffle=False
)
fireredtts/modules/semantic_tokenizer/semantic_tokenizer.py:820
↓ 1 callersMethodforward(
self, wav, wav_length=None, enable_vq=True, decode=True, update_codebook=True
)
fireredtts/modules/acoustic_codec/bigcodec.py:620
↓ 1 callersMethodforward(
self,
wav,
wav_length,
enable_vq=True,
decode=True,
extract_
fireredtts/modules/semantic_tokenizer/semantic_tokenizer.py:754
↓ 1 callersMethodforward_qkv Args: query,key,value: shape (b, t, c) Returns: query,key,value: shape (b, nh, t, c//nh)
fireredtts/modules/flowmatching/upsample_encoder.py:27