MCPcopy Create free account

hub / github.com/VITA-MLLM/VITA-Audio / functions

Functions566 in github.com/VITA-MLLM/VITA-Audio

Functioncosyvoice2
()
tools/get_neural_audio_codecs.py:134
Methodcreate_optimizer
Setup the optimizer. We provide a reasonable default that works well. If you want to use something else, you can pass a tuple in the
tools/trainer_v4_48_3.py:423
Functioncustom_init_weights
(module)
tools/inference_sts.py:180
Functiondac
()
tools/get_neural_audio_codecs.py:179
Methoddecode
(self, audio_tokens, option_steps=10, **kwargs)
vita_audio/tokenizer_sensevoice_glm4voice.py:196
Methoddecode
(self, audio_tokens, option_steps=10, **kwargs)
vita_audio/tokenizer_glm4voice.py:144
Methoddecode
(self, prompt_speech_token, source_speech_16k=None)
vita_audio/tokenizer_sensevoice_sparktts.py:153
Methoddecode
(self, prompt_speech_token, source_speech_16k=None)
vita_audio/tokenizer_cosyvoice2.py:126
Functiondisconnect_user
(sid)
web_demo_stream.py:425
Functioneager_attention_forward
( module: nn.Module, query: torch.Tensor, key: torch.Tensor, value: torch.Tensor, attentio
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:151
Functioneager_attention_forward
( module: nn.Module, query: torch.Tensor, key: torch.Tensor, value: torch.Tensor, attentio
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:106
Functioneager_attention_forward
( module: nn.Module, query: torch.Tensor, key: torch.Tensor, value: torch.Tensor, attentio
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:148
Methodencode
(self, audio_path, is_discrete=False, is_contiguous=True, **kwargs)
vita_audio/tokenizer_sensevoice_glm4voice.py:151
Methodencode
(self, audio_path, **kwargs)
vita_audio/tokenizer_glm4voice.py:134
Methodencode
(self, audio_path, is_discrete=False, is_contiguous=True, **kwargs)
vita_audio/tokenizer_sensevoice_sparktts.py:119
Methodencode
(self, audio_path, **kwargs)
vita_audio/tokenizer_cosyvoice2.py:108
Functionencodec
()
tools/get_neural_audio_codecs.py:10
Methodexpand2square
(pil_img, background_color)
vita_audio/data/processor/image_processor.py:188
Methodextra_repr
(self)
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:269
Methodextra_repr
(self)
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:224
Methodextra_repr
(self)
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:266
Functionformat_function_general
(examples)
vita_audio/data/dataset_base.py:254
Methodforward
(self, x)
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:100
Methodforward
( self, hidden_states: torch.Tensor, position_embeddings: Tuple[torch.Tensor, torch.Te
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:194
Methodforward
(self, hidden_states)
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:262
Methodforward
( self, hidden_states: torch.Tensor, attention_mask: Optional[torch.Tensor] = None,
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:287
Methodforward
(self, x, position_ids)
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:368
Methodforward
( self, input_ids: torch.LongTensor = None, attention_mask: Optional[torch.Tensor] = N
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:550
Methodforward
r""" Args: labels (`torch.LongTensor` of shape `(batch_size, sequence_length)`, *optional*): Labels for computing
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:952
Methodforward
r""" labels (`torch.LongTensor` of shape `(batch_size,)`, *optional*): Labels for computing the sequence classification/regression
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:1382
Methodforward
r""" labels (`torch.LongTensor` of shape `(batch_size,)`, *optional*): Labels for computing the sequence classification/regression
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:1490
Methodforward
r""" start_positions (`torch.LongTensor` of shape `(batch_size,)`, *optional*): Labels for position (index) of the start of the la
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:1567
Methodforward
(self, x, *args, **kwargs)
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/resampler_projector.py:22
Methodforward
( self, hidden_states: torch.Tensor, position_embeddings: Tuple[torch.Tensor, torch.Te
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modular_qwen2.py:46
Methodforward
(self, x)
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:118
Methodforward
Forward function.
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:144
Methodforward
Compute scaled dot product attention. Args: query (torch.Tensor): Query tensor (#batch, time1, size). key (torch.Tens
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:282
Methodforward
(self, input)
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:347
Methodforward
Compute encoded features. Args: x_input (torch.Tensor): Input tensor (#batch, time, size). mask (torch.Tensor): Mask
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:398
Methodforward
Embed positions in tensor.
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:622
Methodforward
Encoder + Decoder + Calc loss Args: speech: (Batch, Length, ...) speech_lengths: (Batch, ) tex
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:735
Methodforward
( self, audios, )
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:1087
Methodforward
(self, x)
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:55
Methodforward
( self, hidden_states: torch.Tensor, position_embeddings: Tuple[torch.Tensor, torch.Te
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:149
Methodforward
(self, hidden_states)
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:217
Methodforward
( self, hidden_states: torch.Tensor, attention_mask: Optional[torch.Tensor] = None,
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:242
Methodforward
(self, x, position_ids)
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:323
Methodforward
( self, input_ids: torch.LongTensor = None, attention_mask: Optional[torch.Tensor] = N
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:502
Methodforward
r""" Args: labels (`torch.LongTensor` of shape `(batch_size, sequence_length)`, *optional*): Labels for computing
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:766
Methodforward
r""" labels (`torch.LongTensor` of shape `(batch_size,)`, *optional*): Labels for computing the sequence classification/regression
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:886
Methodforward
r""" labels (`torch.LongTensor` of shape `(batch_size,)`, *optional*): Labels for computing the sequence classification/regression
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:994
Methodforward
r""" start_positions (`torch.LongTensor` of shape `(batch_size,)`, *optional*): Labels for position (index) of the start of the la
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:1071
Methodforward
( self, hidden_states: torch.Tensor, position_embeddings: Tuple[torch.Tensor, torch.Te
vita_audio/models/qwen2_v4_48_3/modular_qwen2.py:46
Methodforward
(self, x)
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:97
Methodforward
( self, hidden_states: torch.Tensor, position_embeddings: Tuple[torch.Tensor, torch.Te
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:191
Methodforward
(self, hidden_states)
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:259
Methodforward
( self, hidden_states: torch.Tensor, attention_mask: Optional[torch.Tensor] = None,
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:284
Methodforward
(self, x, position_ids)
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:365
Methodforward
( self, input_ids: torch.LongTensor = None, attention_mask: Optional[torch.Tensor] = N
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:544
Methodforward
r""" Args: labels (`torch.LongTensor` of shape `(batch_size, sequence_length)`, *optional*): Labels for computing
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:899
Methodforward
r""" labels (`torch.LongTensor` of shape `(batch_size,)`, *optional*): Labels for computing the sequence classification/regression
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:1325
Methodforward
r""" labels (`torch.LongTensor` of shape `(batch_size,)`, *optional*): Labels for computing the sequence classification/regression
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:1433
Methodforward
r""" start_positions (`torch.LongTensor` of shape `(batch_size,)`, *optional*): Labels for position (index) of the start of the la
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:1510
Methodforward
( self, hidden_states: torch.Tensor, position_embeddings: Tuple[torch.Tensor, torch.Te
vita_audio/models/qwen2_mtp_v4_48_3/modular_qwen2.py:46
Methodforward_chunk
Compute scaled dot product attention. Args: query (torch.Tensor): Query tensor (#batch, time1, size). key (torch.Tens
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:303
Methodforward_chunk
Compute encoded features. Args: x_input (torch.Tensor): Input tensor (#batch, time, size). mask (torch.Tensor): Mask
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:476
Methodgenerate_inner
(self, msg: dict)
Kimi-Audio-Evalkit/almeval/models/vita_audio.py:128
Methodget
Retrieve an item from the queue in a thread-safe manner. Parameters: - None Returns: - any or None: The ret
web/queue.py:113
Methodget_batch_samples
(self, epoch_iterator, num_batches)
tools/trainer_v4_48_3.py:1176
Methodget_decoder
(self)
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:869
Methodget_decoder
(self)
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:761
Methodget_decoder
(self)
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:816
Methodget_input_embeddings
(self)
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:854
Methodget_input_embeddings
(self)
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:1375
Methodget_input_embeddings
(self)
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:1478
Methodget_input_embeddings
(self)
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:1560
Methodget_input_embeddings
(self)
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:746
Methodget_input_embeddings
(self)
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:879
Methodget_input_embeddings
(self)
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:982
Methodget_input_embeddings
(self)
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:1064
Methodget_input_embeddings
(self)
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:537
Methodget_input_embeddings
(self)
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:801
Methodget_input_embeddings
(self)
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:1318
Methodget_input_embeddings
(self)
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:1421
Methodget_input_embeddings
(self)
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:1503
Methodget_output_embeddings
(self)
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:860
Methodget_output_embeddings
(self)
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:752
Methodget_output_embeddings
(self)
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:807
Methodget_train_dataloader
Returns the training [`~torch.utils.data.DataLoader`]. Will use no sampler if `train_dataset` does not implement `__len__`, a random
tools/trainer_v4_48_3.py:386
Methodget_vocab
(self)
vita_audio/models/qwen2_mtp_v4_48_3/tokenization_qwen2.py:217
Functionglm4voice
()
tools/get_neural_audio_codecs.py:105
Functionhandle_audio
(data)
web_demo_stream.py:534
Functionhandle_connect
()
web_demo_stream.py:443
Functionhandle_disconnect
()
web_demo_stream.py:461
Functionhandle_recording_started
()
web_demo_stream.py:475
Functionhandle_recording_stopped
()
web_demo_stream.py:492
Functionhandle_tts_playing
()
web_demo_stream.py:507
Functionhandle_tts_stopped
()
web_demo_stream.py:514
Methodhas_enough_data
Check if the buffer contains enough data to fulfill a request of a specified length. Parameters: - length (int): The number
web/queue.py:72
Functionindex
()
web_demo_stream.py:438
← previousnext →401–500 of 566, ranked by callers