MCPcopy Create free account

hub / github.com/MoonshotAI/Kimi-Audio / functions

Functions236 in github.com/MoonshotAI/Kimi-Audio

↓ 1 callersMethodto_dtype
(self, dtype)
kimia_infer/models/detokenizer/bigvgan_wrapper.py:25
↓ 1 callersMethodtokenize
(self, speech=None, audio_path=None, sr=16000)
kimia_infer/models/tokenizer/glm4_tokenizer.py:17
↓ 1 callersMethodtokenize_conversation
messages: List[Dict] messages[i] = { "role": "user" | "assistant" | "system", "content": str }
finetune_codes/datasets.py:137
↓ 1 callersMethodtokenize_waveform
(self, audio, kimia_whisper_clip_silence=False)
kimia_infer/models/tokenizer/whisper_Lv3/whisper.py:225
↓ 1 callersFunctiontrain
()
finetune.py:138
↓ 1 callersMethodupdate_incremental_state
( self, reserve_kv_cache_tokens=0, max_kv_cache_tokens=900, condition_cache={"
kimia_infer/models/detokenizer/flow_matching/ode_wrapper.py:134
Method__getitem__
(self, i)
finetune_codes/datasets.py:210
Method__init__
( self, audio_top_k: int, audio_temperature: float, audio_repetition_penalty:
kimia_infer/utils/sampler.py:5
Method__init__
( self, audio_token_ids=None, text_token_ids=None, is_continuous_mask=None, audio_token_loss_mask=None
kimia_infer/utils/data.py:5
Method__init__
(self, model_path: str, load_detokenizer: bool = True)
kimia_infer/api/kimia.py:15
Method__init__
(self, model_path: str, kimia_token_offset: int, kimia_text_audiodelaytokens: int)
kimia_infer/api/prompt_manager.py:16
Method__init__
( self, vocoder: BigVGAN, device: torch.device, h: AttrDict, dtype=None )
kimia_infer/models/detokenizer/bigvgan_wrapper.py:15
Method__init__
( self, vocoder: BigVGANWrapper, fm: StreamingSemanticFMWrapper, look_ahead_to
kimia_infer/models/detokenizer/__init__.py:8
Method__init__
( self, speech_model: DiTPrefix, max_kv_cache_tokens=900, max_prompt_chunk=2,
kimia_infer/models/detokenizer/semantic_fm_prefix_streaming.py:17
Method__init__
( self, net, x_mask, x_cond, use_cfg=False, use_cfg_rescale=Tr
kimia_infer/models/detokenizer/flow_matching/ode_wrapper.py:13
Method__init__
( self, timesteps=1000, sigma_min=1e-4, )
kimia_infer/models/detokenizer/flow_matching/scheduler.py:30
Method__init__
( self, dim: int, num_heads: int = 8, qkv_bias: bool = False, qk_norm:
kimia_infer/models/detokenizer/flow_matching/dit_block.py:44
Method__init__
(self, hidden_size, out_channels)
kimia_infer/models/detokenizer/flow_matching/dit_block.py:188
Method__init__
(self, hidden_size, frequency_embedding_size=256)
kimia_infer/models/detokenizer/flow_matching/model.py:41
Method__init__
(self, embedding_dim, padding_idx, init_size=1024)
kimia_infer/models/detokenizer/flow_matching/model.py:91
Method__init__
(self, *args, **kwargs)
kimia_infer/models/detokenizer/vocoder/utils.py:90
Method__init__
( self, h: AttrDict, channels: int, kernel_size: int = 3, dilation: tu
kimia_infer/models/detokenizer/vocoder/bigvgan.py:44
Method__init__
( self, h: AttrDict, channels: int, kernel_size: int = 3, dilation: tu
kimia_infer/models/detokenizer/vocoder/bigvgan.py:159
Method__init__
Initialization. INPUT: - in_features: shape of the input - alpha - trainable parameter that controls frequenc
kimia_infer/models/detokenizer/vocoder/activations.py:80
Method__init__
(self, ratio=2, kernel_size=None)
kimia_infer/models/detokenizer/vocoder/alias_free_activation/torch/resample.py:42
Method__init__
kernel_size should be even number for stylegan3 setup, in this implementation, odd number is also possible.
kimia_infer/models/detokenizer/vocoder/alias_free_activation/torch/filter.py:66
Method__init__
( self, activation, up_ratio: int = 2, down_ratio: int = 2, up_kernel_
kimia_infer/models/detokenizer/vocoder/alias_free_activation/torch/act.py:9
Method__init__
( self, activation, up_ratio: int = 2, down_ratio: int = 2, up_kernel_
kimia_infer/models/detokenizer/vocoder/alias_free_activation/cuda/activation1d.py:36
Method__init__
(self, tokenizer_path)
kimia_infer/models/tokenizer/glm4_tokenizer.py:12
Method__init__
( self, num_positions: int, embedding_dim: int, padding_idx: Optional[int] = None )
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:278
Method__init__
( self, embed_dim: int, num_heads: int, dropout: float = 0.0, is_decod
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:292
Method__init__
(self, config: WhisperConfig)
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:561
Method__init__
(self, config: WhisperConfig)
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:656
Method__init__
(self, config: WhisperConfig)
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:955
Method__init__
(self, config: WhisperConfig)
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:1159
Method__init__
( self, model_path, mel_batch_size=40, unfreeze_online_whisper_model=False )
kimia_infer/models/tokenizer/whisper_Lv3/whisper.py:168
Method__init__
(self, dim, max_position_embeddings=2048, base=10000, device=None)
finetune_codes/modeling_kimia.py:191
Method__init__
(self, config: KimiAudioConfig)
finetune_codes/modeling_kimia.py:235
Method__init__
(self, config: KimiAudioConfig)
finetune_codes/modeling_kimia.py:446
Method__init__
(self, config: KimiAudioConfig)
finetune_codes/modeling_kimia.py:544
Method__init__
(self, config)
finetune_codes/modeling_kimia.py:822
Method__init__
( self, vocab_size=163840, hidden_size=4096, intermediate_size=11008,
finetune_codes/configuration_moonshot_kimia.py:5
Method__init__
(self, raw_data_list, whisper_model, text_tokenizer, max_len: int, kimia_token_offset: int)
finetune_codes/datasets.py:12
Method__init__
(self, config)
finetune_codes/model.py:14
Method__init__
(self, output_dir: str)
finetune_codes/demo_data/audio_understanding/prepare_librispeech_asrtask.py:9
Method__len__
(self)
finetune_codes/datasets.py:31
Method_basic_init
(module)
kimia_infer/models/detokenizer/flow_matching/model.py:264
Method_from_pretrained
Load Pytorch pretrained weights and return the loaded model.
kimia_infer/models/detokenizer/vocoder/bigvgan.py:406
Method_get_feat_extract_output_lengths
Computes the output length of the convolutional layers
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:808
Method_init_weights
(self, module)
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:793
Method_prepare_decoder_attention_mask
( self, attention_mask, input_shape, inputs_embeds, past_key_values_length )
finetune_codes/modeling_kimia.py:582
Method_save_pretrained
Save weights and config.json from a Pytorch model to a local directory.
kimia_infer/models/detokenizer/vocoder/bigvgan.py:395
Method_set_gradient_checkpointing
(self, module, value=False)
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:804
Methodadd_noise
(self)
kimia_infer/models/detokenizer/flow_matching/scheduler.py:25
Methodadd_noise
( self, original_samples: torch.FloatTensor, noise: torch.FloatTensor, timeste
kimia_infer/models/detokenizer/flow_matching/scheduler.py:86
Methodaudio_prepend
(self, index: int, is_continuous: bool = False, audio_token_loss_mask: bool = False)
kimia_infer/utils/data.py:35
Methodaudio_pretend
(self, ids: list[int], is_continuous: bool = False, audio_token_loss_mask: bool = False)
kimia_infer/utils/data.py:44
Methodbackward
(ctx, output_grads)
kimia_infer/models/detokenizer/vocoder/alias_free_activation/cuda/activation1d.py:30
Methodclear_all_states
(self)
kimia_infer/models/detokenizer/semantic_fm_prefix_streaming.py:215
Methodcollate_fn
(batch)
finetune_codes/datasets.py:244
Functioncompute_loss
(outputs, labels, num_items_in_batch=None)
finetune.py:121
Methodcreate_custom_forward
(module)
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:1098
Methodcreate_custom_forward
(module)
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:1384
Methodcustom_forward
(*inputs)
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:1099
Methodcustom_forward
(*inputs)
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:1385
Methoddecode_mel_batch
params: mel: [B, T, num_mels], torch.tensor return: wav: [B, 1, T], torch.tensor
kimia_infer/models/detokenizer/bigvgan_wrapper.py:87
Functiondetokenize
(detokenizer, tokens, ref_wav, ref_tokens)
kimia_infer/models/detokenizer/__init__.py:283
Functiondetokenize_noref
(detokenizer, tokens)
kimia_infer/models/detokenizer/__init__.py:328
Functiondetokenize_noref_streaming
(detokenizer, tokens)
kimia_infer/models/detokenizer/__init__.py:351
Functiondetokenize_streaming
(detokenizer, tokens, ref_wav, ref_tokens)
kimia_infer/models/detokenizer/__init__.py:307
Methodextract_mel_from_wav_batch
params: wav_data: torch.tensor or numpy array, shape [Batch, T], wav data, should be 24k return: mel: [Batch,
kimia_infer/models/detokenizer/bigvgan_wrapper.py:54
Methodforward
(self, t, x, args=None)
kimia_infer/models/detokenizer/flow_matching/ode_wrapper.py:215
Methodforward
( self, x: torch.Tensor, seq_len, cu_seqlens, max_seqlen, cu_s
kimia_infer/models/detokenizer/flow_matching/dit_block.py:70
Methodforward
(self, x, c)
kimia_infer/models/detokenizer/flow_matching/dit_block.py:196
Methodforward
( self, x, c, seq_len, cu_seqlens, cu_maxlen, cu_seqle
kimia_infer/models/detokenizer/flow_matching/dit_block.py:245
Methodforward
(self, t)
kimia_infer/models/detokenizer/flow_matching/model.py:79
Methodforward
Input is expected to be of size [bsz x seqlen].
kimia_infer/models/detokenizer/flow_matching/model.py:129
Methodforward
Forward pass of DiT. x: (N, T, C) tensor of inputs (latent representations of speech) position_ids: (N, T) tensor of position
kimia_infer/models/detokenizer/flow_matching/model.py:287
Methodforward
(self, x)
kimia_infer/models/detokenizer/vocoder/bigvgan.py:128
Methodforward
(self, x)
kimia_infer/models/detokenizer/vocoder/bigvgan.py:224
Methodforward
Forward pass of the function. Applies the function to the input elementwise. Snake ∶= x + 1/a * sin^2 (xa)
kimia_infer/models/detokenizer/vocoder/activations.py:48
Methodforward
Forward pass of the function. Applies the function to the input elementwise. SnakeBeta ∶= x + 1/b * sin^2 (xa)
kimia_infer/models/detokenizer/vocoder/activations.py:110
Methodforward
(self, x)
kimia_infer/models/detokenizer/vocoder/alias_free_activation/torch/resample.py:29
Methodforward
(self, x)
kimia_infer/models/detokenizer/vocoder/alias_free_activation/torch/resample.py:55
Methodforward
(self, x)
kimia_infer/models/detokenizer/vocoder/alias_free_activation/torch/filter.py:94
Methodforward
(self, x)
kimia_infer/models/detokenizer/vocoder/alias_free_activation/torch/act.py:25
Methodforward
(ctx, inputs, up_ftr, down_ftr, alpha, beta)
kimia_infer/models/detokenizer/vocoder/alias_free_activation/cuda/activation1d.py:22
Methodforward
(self, input_ids, past_key_values_length=0)
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:283
Methodforward
Input shape: Batch x Time x Channel
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:427
Methodforward
Args: hidden_states (`torch.FloatTensor`): input to the layer of shape `(seq_len, batch, embed_dim)` attention_mask (
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:577
Methodforward
Args: hidden_states (`torch.FloatTensor`): input to the layer of shape `(batch, seq_len, embed_dim)` attention_mask (
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:682
Methodforward
r""" Args: input_features (`torch.LongTensor` of shape `(batch_size, feature_size, sequence_length)`): Float value
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:995
Methodforward
r""" Args: input_ids (`torch.LongTensor` of shape `(batch_size, sequence_length)`): Indices of input sequence toke
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:1219
Methodforward
r""" Returns: Example: ```python >>> import torch >>> from transformers import AutoFeatureExtractor, Whisp
kimia_infer/models/tokenizer/whisper_Lv3/modeling_whisper.py:1543
Methodforward
(self, x, seq_len=None)
finetune_codes/modeling_kimia.py:221
Methodforward
( self, hidden_states: torch.Tensor, attention_mask: Optional[torch.Tensor] = None,
finetune_codes/modeling_kimia.py:273
Methodforward
Args: hidden_states (`torch.FloatTensor`): input to the layer of shape `(batch, seq_len, embed_dim)` attention_mask (
finetune_codes/modeling_kimia.py:460
Methodforward
(self, x)
finetune_codes/modeling_kimia.py:530
Methodforward
( self, input_ids: torch.LongTensor = None, text_input_ids: torch.LongTensor = None,
finetune_codes/modeling_kimia.py:609
Methodforward
( self, input_ids: torch.LongTensor = None, text_input_ids: torch.LongTensor = None,
finetune_codes/modeling_kimia.py:850
← previousnext →101–200 of 236, ranked by callers