Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/OpenMOSS/MOSS-TTS
/ types & classes
Types & classes
178 in github.com/OpenMOSS/MOSS-TTS
⨍
Functions
1,298
◇
Types & classes
178
↳
Endpoints
16
↓ 6 callers
Class
ResidualUnit
moss_soundeffect_v2/diffsynth/models/dac_vae.py:680
↓ 6 callers
Class
Snake1d
moss_soundeffect_v2/diffsynth/models/dac_vae.py:325
↓ 6 callers
Class
StreamingEvent
moss_tts_local_v1.5/streaming.py:87
↓ 5 callers
Class
MossQwen3RMSNorm
moss_tts_local_v1.5/qwen3_decoder.py:30
↓ 5 callers
Class
MossTTSRealtimeLocalTransformerRMSNorm
moss_tts_realtime/mossttsrealtime/modeling_mossttsrealtime_local.py:40
↓ 5 callers
Class
MossTTSRealtimeProcessor
Builds MossTTSRealtime prompt inputs with text and audio codebooks. This processor focuses on preparing the mixed text/audio token layout expected
moss_tts_realtime/mossttsrealtime/processing_mossttsrealtime.py:25
↓ 4 callers
Class
AudioStreamDecoder
Decode audio tokens into waveform chunks with optional crossfade.
moss_tts_realtime/mossttsrealtime/streaming_mossttsrealtime.py:733
↓ 4 callers
Class
CaseResult
scripts/batch_eval_llama_cpp.py:80
↓ 4 callers
Class
MossTTSRealtimeInference
Step-wise inference wrapper for MossTTSRealtime. This class mirrors the non-streaming inference logic but exposes a prefill/step/finish API fo
moss_tts_realtime/mossttsrealtime/streaming_mossttsrealtime.py:35
↓ 4 callers
Class
MossTTSRealtimeStreamingSession
Manage text-to-audio streaming for a single conversation.
moss_tts_realtime/mossttsrealtime/streaming_mossttsrealtime.py:476
↓ 3 callers
Class
StreamEvent
moss_tts_realtime/app.py:140
↓ 3 callers
Class
StreamingRequest
moss_tts_local_v1.5/streaming.py:65
↓ 2 callers
Class
AssistantMessage
moss_tts_local/processing_moss_tts.py:124
↓ 2 callers
Class
AssistantMessage
moss_tts_delay/processing_moss_tts.py:125
↓ 2 callers
Class
AssistantMessage
moss_tts_local_v1.5/processing_moss_tts.py:168
↓ 2 callers
Class
AttentionModule
moss_soundeffect_v2/diffsynth/models/wan_video_dit.py:135
↓ 2 callers
Class
AudioDataset
moss_soundeffect_v2/diffsynth/trainers/utils.py:324
↓ 2 callers
Class
BackendPaths
moss_tts_realtime/app.py:95
↓ 2 callers
Class
BackendPaths
moss_tts_realtime/fast_api.py:56
↓ 2 callers
Class
DiTBlock
moss_soundeffect_v2/diffsynth/models/wan_video_dit.py:217
↓ 2 callers
Class
EmbeddingLookup
Sum-of-embeddings lookup for the MOSS-TTS-Delay multi-channel input.
moss_tts_delay/llama_cpp/embedding.py:26
↓ 2 callers
Class
FileLock
moss_soundeffect_v2/diffsynth/trainers/cache_shards.py:32
↓ 2 callers
Class
LlamaCppBackbone
Wrapper around the Qwen3 backbone running in llama.cpp. Accepts embedding vectors as input (bypassing tok_embd) and returns hidden states (af
moss_tts_delay/llama_cpp/backbone.py:116
↓ 2 callers
Class
LlamaCppPipeline
Full MOSS-TTS-Delay inference pipeline using llama.cpp backbone. When ``config.low_memory`` is True, GPU-heavy components (backbone, audio en
moss_tts_delay/llama_cpp/pipeline.py:353
↓ 2 callers
Class
MossTTSMLP
HF-style MLP adapter equivalent to Megatron's SwiGLU FFN: in: input_size mid: ffn_hidden_size out: output_size Computes:
moss_tts_local/modeling_moss_tts.py:47
↓ 2 callers
Class
MossTTSRMSNorm
moss_tts_local/modeling_moss_tts.py:34
↓ 2 callers
Class
SimpleAdapter
moss_soundeffect_v2/diffsynth/models/wan_video_camera_controller.py:8
↓ 2 callers
Class
StatefulCodecDecoder
moss_tts_local_v1.5/streaming.py:572
↓ 2 callers
Class
StreamingCallbacks
moss_tts_realtime/fast_api.py:85
↓ 2 callers
Class
WanPrompter
moss_soundeffect_v2/diffsynth/prompters/wan_prompter.py:83
↓ 2 callers
Class
_Dec
moss_tts_delay/llama_cpp/pipeline.py:132
↓ 2 callers
Class
_Enc
moss_tts_delay/llama_cpp/pipeline.py:103
↓ 1 callers
Class
AudioFrameDecoder
moss_tts_realtime/app.py:200
↓ 1 callers
Class
AudioFrameDecoder
moss_tts_realtime/fast_api.py:111
↓ 1 callers
Class
AudioReaderState
moss_tts_realtime/tts_client.py:27
↓ 1 callers
Class
BufferedAudioTracker
moss_tts_realtime/app.py:179
↓ 1 callers
Class
BufferedAudioTracker
moss_tts_realtime/fast_api.py:90
↓ 1 callers
Class
Camera
Copied from https://github.com/hehao13/CameraCtrl/blob/main/inference.py
moss_soundeffect_v2/diffsynth/models/wan_video_camera_controller.py:77
↓ 1 callers
Class
CrossAttention
moss_soundeffect_v2/diffsynth/models/wan_video_dit.py:171
↓ 1 callers
Class
DAC
moss_soundeffect_v2/diffsynth/models/dac_vae.py:804
↓ 1 callers
Class
DACFile
moss_soundeffect_v2/diffsynth/models/dac_vae.py:19
↓ 1 callers
Class
Decoder
moss_soundeffect_v2/diffsynth/models/dac_vae.py:772
↓ 1 callers
Class
DecoderBlock
moss_soundeffect_v2/diffsynth/models/dac_vae.py:750
↓ 1 callers
Class
DelayState
Mutable state for one generation sequence (batch_size=1).
moss_tts_delay/llama_cpp/delay_state.py:54
↓ 1 callers
Class
DiagonalGaussianDistribution
moss_soundeffect_v2/diffsynth/models/dac_vae.py:604
↓ 1 callers
Class
Encoder
moss_soundeffect_v2/diffsynth/models/dac_vae.py:720
↓ 1 callers
Class
EncoderBlock
moss_soundeffect_v2/diffsynth/models/dac_vae.py:699
↓ 1 callers
Class
FlowMatchScheduler
moss_soundeffect_v2/diffsynth/schedulers/flow_match.py:5
↓ 1 callers
Class
GateModule
moss_soundeffect_v2/diffsynth/models/wan_video_dit.py:210
↓ 1 callers
Class
GenerationConfig
moss_tts_realtime/app.py:104
↓ 1 callers
Class
GenerationConfig
moss_tts_realtime/fast_api.py:65
↓ 1 callers
Class
GpuMonitor
Accumulates labelled GPU memory snapshots and prints a summary.
moss_tts_delay/llama_cpp/gpu_monitor.py:129
↓ 1 callers
Class
Head
moss_soundeffect_v2/diffsynth/models/wan_audio_dit.py:77
↓ 1 callers
Class
Head
moss_soundeffect_v2/diffsynth/models/wan_video_dit.py:274
↓ 1 callers
Class
HuggingfaceTokenizer
moss_soundeffect_v2/diffsynth/prompters/wan_prompter.py:35
↓ 1 callers
Class
MLP
moss_soundeffect_v2/diffsynth/models/wan_audio_dit.py:57
↓ 1 callers
Class
MLP
moss_soundeffect_v2/diffsynth/models/wan_video_dit.py:254
↓ 1 callers
Class
MosiTTSModel
moss_tts_local/modeling_moss_tts.py:495
↓ 1 callers
Class
MosiTTSOutputWithPast
moss_tts_local/modeling_moss_tts.py:295
↓ 1 callers
Class
MossQwen3Attention
moss_tts_local_v1.5/qwen3_decoder.py:119
↓ 1 callers
Class
MossQwen3DecoderLayer
moss_tts_local_v1.5/qwen3_decoder.py:359
↓ 1 callers
Class
MossQwen3MLP
moss_tts_local_v1.5/qwen3_decoder.py:107
↓ 1 callers
Class
MossQwen3Model
moss_tts_local_v1.5/qwen3_decoder.py:394
↓ 1 callers
Class
MossQwen3RotaryEmbedding
moss_tts_local_v1.5/qwen3_decoder.py:44
↓ 1 callers
Class
MossSoundEffectFinetuneModule
moss_soundeffect_v2/finetuning/finetuning.py:38
↓ 1 callers
Class
MossSoundEffectPipelineOutput
Container returned by :meth:`MossSoundEffectPipeline.__call__`.
moss_soundeffect_v2/pipeline_moss_soundeffect.py:24
↓ 1 callers
Class
MossTTSAttentionWithoutPositionalEmbedding
Multi-headed attention from 'Attention Is All You Need' paper
moss_tts_local/modeling_moss_tts.py:126
↓ 1 callers
Class
MossTTSDelayConfig
r""" This is the configuration class to store the configuration of a [`MossTTSDelayModel`]. It is used to instantiate an MossTTSDelay model ac
moss_tts_local/configuration_moss_tts.py:25
↓ 1 callers
Class
MossTTSDelayConfig
r""" This is the configuration class to store the configuration of a [`MossTTSDelayModel`]. It is used to instantiate an MossTTSDelay model ac
moss_tts_delay/configuration_moss_tts.py:25
↓ 1 callers
Class
MossTTSDelayOutputWithPast
Base class for model's outputs that may also contain a past key/values (to speed up sequential decoding). Args: loss (`torch.FloatTe
moss_tts_delay/modeling_moss_tts.py:53
↓ 1 callers
Class
MossTTSDelayProcessor
moss_tts_local/processing_moss_tts.py:148
↓ 1 callers
Class
MossTTSDelayProcessor
moss_tts_delay/processing_moss_tts.py:149
↓ 1 callers
Class
MossTTSGenerateDecoderOnlyOutput
moss_tts_local/modeling_moss_tts.py:306
↓ 1 callers
Class
MossTTSLocalConfig
moss_tts_local_v1.5/configuration_moss_tts.py:28
↓ 1 callers
Class
MossTTSLocalOutput
moss_tts_local_v1.5/modeling_moss_tts.py:22
↓ 1 callers
Class
MossTTSLocalTransformer
moss_tts_local/modeling_moss_tts.py:178
↓ 1 callers
Class
MossTTSLocalV15SFTDataset
moss_tts_local_v1.5/finetuning/dataset.py:58
↓ 1 callers
Class
MossTTSNanoGPT2Attention
moss_tts_local_v1.5/gpt2_decoder.py:101
↓ 1 callers
Class
MossTTSNanoGPT2Block
moss_tts_local_v1.5/gpt2_decoder.py:390
↓ 1 callers
Class
MossTTSNanoGPT2MLP
moss_tts_local_v1.5/gpt2_decoder.py:84
↓ 1 callers
Class
MossTTSNanoGPT2Model
moss_tts_local_v1.5/gpt2_decoder.py:421
↓ 1 callers
Class
MossTTSNanoGPT2RotaryEmbedding
moss_tts_local_v1.5/gpt2_decoder.py:40
↓ 1 callers
Class
MossTTSRealtimeInference
moss_tts_realtime/inferencer.py:62
↓ 1 callers
Class
MossTTSRealtimeLocalTransformer
moss_tts_realtime/mossttsrealtime/modeling_mossttsrealtime_local.py:270
↓ 1 callers
Class
MossTTSRealtimeLocalTransformerAttention
moss_tts_realtime/mossttsrealtime/modeling_mossttsrealtime_local.py:118
↓ 1 callers
Class
MossTTSRealtimeLocalTransformerDecoderLayer
moss_tts_realtime/mossttsrealtime/modeling_mossttsrealtime_local.py:180
↓ 1 callers
Class
MossTTSRealtimeLocalTransformerMLP
moss_tts_realtime/mossttsrealtime/modeling_mossttsrealtime_local.py:57
↓ 1 callers
Class
MossTTSRealtimeLocalTransformerRotaryEmbedding
moss_tts_realtime/mossttsrealtime/modeling_mossttsrealtime_local.py:242
↓ 1 callers
Class
MossTTSRealtimeOutputWithPast
moss_tts_realtime/mossttsrealtime/modeling_mossttsrealtime.py:65
↓ 1 callers
Class
MossTTSRealtimeProcessor
moss_tts_realtime/inferencer.py:11
↓ 1 callers
Class
MossTTSRealtimeSFTDataset
Teacher-forcing dataset for MossTTSRealtime supervised fine-tuning. All records use the ``conversations`` format. Labels are only set for as
moss_tts_realtime/finetuning/dataset.py:62
↓ 1 callers
Class
MossTTSSFTDataset
moss_tts_local/finetuning/dataset.py:59
↓ 1 callers
Class
MossTTSSFTDataset
moss_tts_delay/finetuning/dataset.py:59
↓ 1 callers
Class
MyModelLogger
moss_soundeffect_v2/finetuning/finetuning.py:165
↓ 1 callers
Class
NumpyLMHeads
Compute logits from hidden state for all 33 prediction heads (pure NumPy).
moss_tts_delay/llama_cpp/lm_heads.py:24
↓ 1 callers
Class
PackedSequenceMetadata
moss_tts_local_v1.5/gpt2_decoder.py:28
↓ 1 callers
Class
PipelineUnitRunner
moss_soundeffect_v2/diffsynth/utils/__init__.py:180
↓ 1 callers
Class
Qwen3TextEncoder
Wraps Qwen3 (decoder-only) as a text encoder for Wan audio pipeline. Loads the full Qwen3 model and extracts last-layer hidden states as text
moss_soundeffect_v2/diffsynth/models/qwen3_text_encoder.py:6
↓ 1 callers
Class
ResidualBlock
moss_soundeffect_v2/diffsynth/models/wan_video_camera_controller.py:63
↓ 1 callers
Class
ResidualVectorQuantize
Introduced in SoundStream: An end2end neural audio codec https://arxiv.org/abs/2107.03312
moss_soundeffect_v2/diffsynth/models/dac_vae.py:424
next →
1–100 of 178, ranked by callers