Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/VITA-MLLM/VITA-Audio
/ types & classes
Types & classes
121 in github.com/VITA-MLLM/VITA-Audio
⨍
Functions
566
◇
Types & classes
121
↳
Endpoints
4
↓ 5 callers
Class
Qwen2RMSNorm
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:253
↓ 5 callers
Class
Qwen2RMSNorm
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:250
↓ 4 callers
Class
LayerNorm
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:343
↓ 4 callers
Class
Qwen2Model
Transformer decoder consisting of *config.num_hidden_layers* layers. Each layer is a [`Qwen2DecoderLayer`] Args: config: Qwen2Config
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:516
↓ 4 callers
Class
Qwen2Model
Transformer decoder consisting of *config.num_hidden_layers* layers. Each layer is a [`Qwen2DecoderLayer`] Args: config: Qwen2Config
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:471
↓ 4 callers
Class
Qwen2Model
Transformer decoder consisting of *config.num_hidden_layers* layers. Each layer is a [`Qwen2DecoderLayer`] Args: config: Qwen2Config
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:513
↓ 3 callers
Class
EncoderLayerSANM
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:370
↓ 3 callers
Class
Qwen2RMSNorm
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:208
↓ 2 callers
Class
VADIterator
web/vad.py:14
↓ 1 callers
Class
ASRDataset
evaluation/evaluate_asr.py:33
↓ 1 callers
Class
AudioEncoder
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:1065
↓ 1 callers
Class
AudioProcessor
vita_audio/data/processor/audio_processor.py:12
↓ 1 callers
Class
BenchmarkIteratorStreamer
tools/inference_sts.py:128
↓ 1 callers
Class
Calculator
evaluation/compute-cer.py:91
↓ 1 callers
Class
Calculator
evaluation/compute-wer.py:85
↓ 1 callers
Class
CosyVoice2Tokenizer
vita_audio/tokenizer_cosyvoice2.py:66
↓ 1 callers
Class
GLM4VoiceTokenizer
vita_audio/tokenizer_glm4voice.py:77
↓ 1 callers
Class
GlobalParams
web/parms.py:25
↓ 1 callers
Class
ImageProcessor
vita_audio/data/processor/image_processor.py:20
↓ 1 callers
Class
InferenceSampler
evaluation/evaluate_seedtts.py:157
↓ 1 callers
Class
InferenceSampler
evaluation/evaluate_asr.py:127
↓ 1 callers
Class
InferenceSampler
evaluation/evaluate_libritts.py:84
↓ 1 callers
Class
InferenceSampler
evaluation/evaluate_sqa.py:130
↓ 1 callers
Class
PCMQueue
web/queue.py:14
↓ 1 callers
Class
Qwen2Attention
Multi-headed attention from 'Attention Is All You Need' paper
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:177
↓ 1 callers
Class
Qwen2Attention
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modular_qwen2.py:38
↓ 1 callers
Class
Qwen2Attention
Multi-headed attention from 'Attention Is All You Need' paper
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:132
↓ 1 callers
Class
Qwen2Attention
vita_audio/models/qwen2_v4_48_3/modular_qwen2.py:38
↓ 1 callers
Class
Qwen2Attention
Multi-headed attention from 'Attention Is All You Need' paper
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:174
↓ 1 callers
Class
Qwen2Attention
vita_audio/models/qwen2_mtp_v4_48_3/modular_qwen2.py:38
↓ 1 callers
Class
Qwen2DecoderLayer
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:273
↓ 1 callers
Class
Qwen2DecoderLayer
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:228
↓ 1 callers
Class
Qwen2DecoderLayer
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:270
↓ 1 callers
Class
Qwen2MLP
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:89
↓ 1 callers
Class
Qwen2MLP
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modular_qwen2.py:30
↓ 1 callers
Class
Qwen2MLP
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:44
↓ 1 callers
Class
Qwen2MLP
vita_audio/models/qwen2_v4_48_3/modular_qwen2.py:30
↓ 1 callers
Class
Qwen2MLP
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:86
↓ 1 callers
Class
Qwen2MLP
vita_audio/models/qwen2_mtp_v4_48_3/modular_qwen2.py:30
↓ 1 callers
Class
Qwen2RotaryEmbedding
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:330
↓ 1 callers
Class
Qwen2RotaryEmbedding
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:285
↓ 1 callers
Class
Qwen2RotaryEmbedding
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:327
↓ 1 callers
Class
ResamplerProjector
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/resampler_projector.py:8
↓ 1 callers
Class
S2SInference
tools/inference_sts.py:190
↓ 1 callers
Class
SNACTokenizer
vita_audio/tokenizer_snac.py:68
↓ 1 callers
Class
STSDataset
evaluation/evaluate_sqa.py:34
↓ 1 callers
Class
SeedTTSDataset
evaluation/evaluate_seedtts.py:32
↓ 1 callers
Class
SenseVoiceGLM4VoiceTokenizer
vita_audio/tokenizer_sensevoice_glm4voice.py:83
↓ 1 callers
Class
SenseVoiceSparkTTSTokenizer
vita_audio/tokenizer_sensevoice_sparktts.py:70
↓ 1 callers
Class
SinusoidalPositionEncoder
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:93
↓ 1 callers
Class
TTSDataset
evaluation/evaluate_libritts.py:33
↓ 1 callers
Class
TextAudioIteratorStreamer
web_demo_stream.py:162
↓ 1 callers
Class
TextAudioIteratorStreamer
tools/inference_sts.py:71
↓ 1 callers
Class
ThreadSafeQueue
web/queue.py:86
↓ 1 callers
Class
Trainer
tools/trainer_v4_48_3.py:384
↓ 1 callers
Class
WakeupAndVAD
web/vad.py:114
↓ 1 callers
Class
inferencePipelineObject
web/pool.py:58
Class
BaseDataset
vita_audio/data/dataset_base.py:26
Class
CosyVoice2Dataset
vita_audio/data/dataset_cosyvoice2.py:24
Class
DataCollatorForSupervisedDataset
vita_audio/data/data_collator.py:19
Class
DataTrainingArguments
Arguments pertaining to what data we are going to input our model for training and eval.
tools/finetune_sts_v4_48_3.py:178
Class
DeepSeekDataset
vita_audio/data/dataset_deepseek.py:24
Class
HunyuanDataset
vita_audio/data/dataset_hunyuan.py:24
Class
KwargsForCausalLM
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:831
Class
KwargsForCausalLM
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:730
Class
KwargsForCausalLM
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:778
Class
Llama3Dataset
vita_audio/data/dataset_llama3.py:24
Class
MistralDataset
vita_audio/data/dataset_mistral.py:22
Class
ModelArguments
Arguments pertaining to which model/config/tokenizer we are going to fine-tune, or train from scratch.
tools/finetune_sts_v4_48_3.py:55
Class
MultiHeadedAttentionSANM
Multi-Head Attention layer. Args: n_head (int): The number of heads. n_feat (int): The number of features. dropout_rate (
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:149
Class
PooledCodecTTSObject
web/pool.py:18
Class
PositionwiseFeedForward
Positionwise feed forward layer. Args: idim (int): Input dimenstion. hidden_units (int): The number of hidden units. drop
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_sensevoice.py:126
Class
Qwen2Config
r""" This is the configuration class to store the configuration of a [`Qwen2Model`]. It is used to instantiate a Qwen2 model according to the
vita_audio/models/qwen2_v4_48_3/configuration_qwen2.py:25
Class
Qwen2Dataset
vita_audio/data/dataset_qwen2.py:24
Class
Qwen2DecoderLayer
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modular_qwen2.py:105
Class
Qwen2DecoderLayer
vita_audio/models/qwen2_v4_48_3/modular_qwen2.py:105
Class
Qwen2DecoderLayer
vita_audio/models/qwen2_mtp_v4_48_3/modular_qwen2.py:105
Class
Qwen2ForCausalLM
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modular_qwen2.py:121
Class
Qwen2ForCausalLM
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:733
Class
Qwen2ForCausalLM
vita_audio/models/qwen2_v4_48_3/modular_qwen2.py:121
Class
Qwen2ForCausalLM
vita_audio/models/qwen2_mtp_v4_48_3/modular_qwen2.py:121
Class
Qwen2ForQuestionAnswering
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:1549
Class
Qwen2ForQuestionAnswering
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modular_qwen2.py:133
Class
Qwen2ForQuestionAnswering
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:1053
Class
Qwen2ForQuestionAnswering
vita_audio/models/qwen2_v4_48_3/modular_qwen2.py:133
Class
Qwen2ForQuestionAnswering
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:1492
Class
Qwen2ForQuestionAnswering
vita_audio/models/qwen2_mtp_v4_48_3/modular_qwen2.py:133
Class
Qwen2ForSequenceClassification
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:1365
Class
Qwen2ForSequenceClassification
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modular_qwen2.py:125
Class
Qwen2ForSequenceClassification
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:869
Class
Qwen2ForSequenceClassification
vita_audio/models/qwen2_v4_48_3/modular_qwen2.py:125
Class
Qwen2ForSequenceClassification
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:1308
Class
Qwen2ForSequenceClassification
vita_audio/models/qwen2_mtp_v4_48_3/modular_qwen2.py:125
Class
Qwen2ForTokenClassification
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:1461
Class
Qwen2ForTokenClassification
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modular_qwen2.py:129
Class
Qwen2ForTokenClassification
vita_audio/models/qwen2_v4_48_3/modeling_qwen2.py:965
Class
Qwen2ForTokenClassification
vita_audio/models/qwen2_v4_48_3/modular_qwen2.py:129
Class
Qwen2ForTokenClassification
vita_audio/models/qwen2_mtp_v4_48_3/modeling_qwen2.py:1404
Class
Qwen2ForTokenClassification
vita_audio/models/qwen2_mtp_v4_48_3/modular_qwen2.py:129
Class
Qwen2MTPConfig
r""" This is the configuration class to store the configuration of a [`Qwen2Model`]. It is used to instantiate a Qwen2 model according to the
vita_audio/models/qwen2_mtp_v4_48_3/configuration_qwen2.py:25
next →
1–100 of 121, ranked by callers