MCPcopy Create free account

hub / github.com/OpenMOSS/MOSS-TTS / types & classes

Types & classes178 in github.com/OpenMOSS/MOSS-TTS

↓ 6 callersClassResidualUnit
moss_soundeffect_v2/diffsynth/models/dac_vae.py:680
↓ 6 callersClassSnake1d
moss_soundeffect_v2/diffsynth/models/dac_vae.py:325
↓ 6 callersClassStreamingEvent
moss_tts_local_v1.5/streaming.py:87
↓ 5 callersClassMossQwen3RMSNorm
moss_tts_local_v1.5/qwen3_decoder.py:30
↓ 5 callersClassMossTTSRealtimeLocalTransformerRMSNorm
moss_tts_realtime/mossttsrealtime/modeling_mossttsrealtime_local.py:40
↓ 5 callersClassMossTTSRealtimeProcessor
Builds MossTTSRealtime prompt inputs with text and audio codebooks. This processor focuses on preparing the mixed text/audio token layout expected
moss_tts_realtime/mossttsrealtime/processing_mossttsrealtime.py:25
↓ 4 callersClassAudioStreamDecoder
Decode audio tokens into waveform chunks with optional crossfade.
moss_tts_realtime/mossttsrealtime/streaming_mossttsrealtime.py:733
↓ 4 callersClassCaseResult
scripts/batch_eval_llama_cpp.py:80
↓ 4 callersClassMossTTSRealtimeInference
Step-wise inference wrapper for MossTTSRealtime. This class mirrors the non-streaming inference logic but exposes a prefill/step/finish API fo
moss_tts_realtime/mossttsrealtime/streaming_mossttsrealtime.py:35
↓ 4 callersClassMossTTSRealtimeStreamingSession
Manage text-to-audio streaming for a single conversation.
moss_tts_realtime/mossttsrealtime/streaming_mossttsrealtime.py:476
↓ 3 callersClassStreamEvent
moss_tts_realtime/app.py:140
↓ 3 callersClassStreamingRequest
moss_tts_local_v1.5/streaming.py:65
↓ 2 callersClassAssistantMessage
moss_tts_local/processing_moss_tts.py:124
↓ 2 callersClassAssistantMessage
moss_tts_delay/processing_moss_tts.py:125
↓ 2 callersClassAssistantMessage
moss_tts_local_v1.5/processing_moss_tts.py:168
↓ 2 callersClassAttentionModule
moss_soundeffect_v2/diffsynth/models/wan_video_dit.py:135
↓ 2 callersClassAudioDataset
moss_soundeffect_v2/diffsynth/trainers/utils.py:324
↓ 2 callersClassBackendPaths
moss_tts_realtime/app.py:95
↓ 2 callersClassBackendPaths
moss_tts_realtime/fast_api.py:56
↓ 2 callersClassDiTBlock
moss_soundeffect_v2/diffsynth/models/wan_video_dit.py:217
↓ 2 callersClassEmbeddingLookup
Sum-of-embeddings lookup for the MOSS-TTS-Delay multi-channel input.
moss_tts_delay/llama_cpp/embedding.py:26
↓ 2 callersClassFileLock
moss_soundeffect_v2/diffsynth/trainers/cache_shards.py:32
↓ 2 callersClassLlamaCppBackbone
Wrapper around the Qwen3 backbone running in llama.cpp. Accepts embedding vectors as input (bypassing tok_embd) and returns hidden states (af
moss_tts_delay/llama_cpp/backbone.py:116
↓ 2 callersClassLlamaCppPipeline
Full MOSS-TTS-Delay inference pipeline using llama.cpp backbone. When ``config.low_memory`` is True, GPU-heavy components (backbone, audio en
moss_tts_delay/llama_cpp/pipeline.py:353
↓ 2 callersClassMossTTSMLP
HF-style MLP adapter equivalent to Megatron's SwiGLU FFN: in: input_size mid: ffn_hidden_size out: output_size Computes:
moss_tts_local/modeling_moss_tts.py:47
↓ 2 callersClassMossTTSRMSNorm
moss_tts_local/modeling_moss_tts.py:34
↓ 2 callersClassSimpleAdapter
moss_soundeffect_v2/diffsynth/models/wan_video_camera_controller.py:8
↓ 2 callersClassStatefulCodecDecoder
moss_tts_local_v1.5/streaming.py:572
↓ 2 callersClassStreamingCallbacks
moss_tts_realtime/fast_api.py:85
↓ 2 callersClassWanPrompter
moss_soundeffect_v2/diffsynth/prompters/wan_prompter.py:83
↓ 2 callersClass_Dec
moss_tts_delay/llama_cpp/pipeline.py:132
↓ 2 callersClass_Enc
moss_tts_delay/llama_cpp/pipeline.py:103
↓ 1 callersClassAudioFrameDecoder
moss_tts_realtime/app.py:200
↓ 1 callersClassAudioFrameDecoder
moss_tts_realtime/fast_api.py:111
↓ 1 callersClassAudioReaderState
moss_tts_realtime/tts_client.py:27
↓ 1 callersClassBufferedAudioTracker
moss_tts_realtime/app.py:179
↓ 1 callersClassBufferedAudioTracker
moss_tts_realtime/fast_api.py:90
↓ 1 callersClassCamera
Copied from https://github.com/hehao13/CameraCtrl/blob/main/inference.py
moss_soundeffect_v2/diffsynth/models/wan_video_camera_controller.py:77
↓ 1 callersClassCrossAttention
moss_soundeffect_v2/diffsynth/models/wan_video_dit.py:171
↓ 1 callersClassDAC
moss_soundeffect_v2/diffsynth/models/dac_vae.py:804
↓ 1 callersClassDACFile
moss_soundeffect_v2/diffsynth/models/dac_vae.py:19
↓ 1 callersClassDecoder
moss_soundeffect_v2/diffsynth/models/dac_vae.py:772
↓ 1 callersClassDecoderBlock
moss_soundeffect_v2/diffsynth/models/dac_vae.py:750
↓ 1 callersClassDelayState
Mutable state for one generation sequence (batch_size=1).
moss_tts_delay/llama_cpp/delay_state.py:54
↓ 1 callersClassDiagonalGaussianDistribution
moss_soundeffect_v2/diffsynth/models/dac_vae.py:604
↓ 1 callersClassEncoder
moss_soundeffect_v2/diffsynth/models/dac_vae.py:720
↓ 1 callersClassEncoderBlock
moss_soundeffect_v2/diffsynth/models/dac_vae.py:699
↓ 1 callersClassFlowMatchScheduler
moss_soundeffect_v2/diffsynth/schedulers/flow_match.py:5
↓ 1 callersClassGateModule
moss_soundeffect_v2/diffsynth/models/wan_video_dit.py:210
↓ 1 callersClassGenerationConfig
moss_tts_realtime/app.py:104
↓ 1 callersClassGenerationConfig
moss_tts_realtime/fast_api.py:65
↓ 1 callersClassGpuMonitor
Accumulates labelled GPU memory snapshots and prints a summary.
moss_tts_delay/llama_cpp/gpu_monitor.py:129
↓ 1 callersClassHead
moss_soundeffect_v2/diffsynth/models/wan_audio_dit.py:77
↓ 1 callersClassHead
moss_soundeffect_v2/diffsynth/models/wan_video_dit.py:274
↓ 1 callersClassHuggingfaceTokenizer
moss_soundeffect_v2/diffsynth/prompters/wan_prompter.py:35
↓ 1 callersClassMLP
moss_soundeffect_v2/diffsynth/models/wan_audio_dit.py:57
↓ 1 callersClassMLP
moss_soundeffect_v2/diffsynth/models/wan_video_dit.py:254
↓ 1 callersClassMosiTTSModel
moss_tts_local/modeling_moss_tts.py:495
↓ 1 callersClassMosiTTSOutputWithPast
moss_tts_local/modeling_moss_tts.py:295
↓ 1 callersClassMossQwen3Attention
moss_tts_local_v1.5/qwen3_decoder.py:119
↓ 1 callersClassMossQwen3DecoderLayer
moss_tts_local_v1.5/qwen3_decoder.py:359
↓ 1 callersClassMossQwen3MLP
moss_tts_local_v1.5/qwen3_decoder.py:107
↓ 1 callersClassMossQwen3Model
moss_tts_local_v1.5/qwen3_decoder.py:394
↓ 1 callersClassMossQwen3RotaryEmbedding
moss_tts_local_v1.5/qwen3_decoder.py:44
↓ 1 callersClassMossSoundEffectFinetuneModule
moss_soundeffect_v2/finetuning/finetuning.py:38
↓ 1 callersClassMossSoundEffectPipelineOutput
Container returned by :meth:`MossSoundEffectPipeline.__call__`.
moss_soundeffect_v2/pipeline_moss_soundeffect.py:24
↓ 1 callersClassMossTTSAttentionWithoutPositionalEmbedding
Multi-headed attention from 'Attention Is All You Need' paper
moss_tts_local/modeling_moss_tts.py:126
↓ 1 callersClassMossTTSDelayConfig
r""" This is the configuration class to store the configuration of a [`MossTTSDelayModel`]. It is used to instantiate an MossTTSDelay model ac
moss_tts_local/configuration_moss_tts.py:25
↓ 1 callersClassMossTTSDelayConfig
r""" This is the configuration class to store the configuration of a [`MossTTSDelayModel`]. It is used to instantiate an MossTTSDelay model ac
moss_tts_delay/configuration_moss_tts.py:25
↓ 1 callersClassMossTTSDelayOutputWithPast
Base class for model's outputs that may also contain a past key/values (to speed up sequential decoding). Args: loss (`torch.FloatTe
moss_tts_delay/modeling_moss_tts.py:53
↓ 1 callersClassMossTTSDelayProcessor
moss_tts_local/processing_moss_tts.py:148
↓ 1 callersClassMossTTSDelayProcessor
moss_tts_delay/processing_moss_tts.py:149
↓ 1 callersClassMossTTSGenerateDecoderOnlyOutput
moss_tts_local/modeling_moss_tts.py:306
↓ 1 callersClassMossTTSLocalConfig
moss_tts_local_v1.5/configuration_moss_tts.py:28
↓ 1 callersClassMossTTSLocalOutput
moss_tts_local_v1.5/modeling_moss_tts.py:22
↓ 1 callersClassMossTTSLocalTransformer
moss_tts_local/modeling_moss_tts.py:178
↓ 1 callersClassMossTTSLocalV15SFTDataset
moss_tts_local_v1.5/finetuning/dataset.py:58
↓ 1 callersClassMossTTSNanoGPT2Attention
moss_tts_local_v1.5/gpt2_decoder.py:101
↓ 1 callersClassMossTTSNanoGPT2Block
moss_tts_local_v1.5/gpt2_decoder.py:390
↓ 1 callersClassMossTTSNanoGPT2MLP
moss_tts_local_v1.5/gpt2_decoder.py:84
↓ 1 callersClassMossTTSNanoGPT2Model
moss_tts_local_v1.5/gpt2_decoder.py:421
↓ 1 callersClassMossTTSNanoGPT2RotaryEmbedding
moss_tts_local_v1.5/gpt2_decoder.py:40
↓ 1 callersClassMossTTSRealtimeInference
moss_tts_realtime/inferencer.py:62
↓ 1 callersClassMossTTSRealtimeLocalTransformer
moss_tts_realtime/mossttsrealtime/modeling_mossttsrealtime_local.py:270
↓ 1 callersClassMossTTSRealtimeLocalTransformerAttention
moss_tts_realtime/mossttsrealtime/modeling_mossttsrealtime_local.py:118
↓ 1 callersClassMossTTSRealtimeLocalTransformerDecoderLayer
moss_tts_realtime/mossttsrealtime/modeling_mossttsrealtime_local.py:180
↓ 1 callersClassMossTTSRealtimeLocalTransformerMLP
moss_tts_realtime/mossttsrealtime/modeling_mossttsrealtime_local.py:57
↓ 1 callersClassMossTTSRealtimeLocalTransformerRotaryEmbedding
moss_tts_realtime/mossttsrealtime/modeling_mossttsrealtime_local.py:242
↓ 1 callersClassMossTTSRealtimeOutputWithPast
moss_tts_realtime/mossttsrealtime/modeling_mossttsrealtime.py:65
↓ 1 callersClassMossTTSRealtimeProcessor
moss_tts_realtime/inferencer.py:11
↓ 1 callersClassMossTTSRealtimeSFTDataset
Teacher-forcing dataset for MossTTSRealtime supervised fine-tuning. All records use the ``conversations`` format. Labels are only set for as
moss_tts_realtime/finetuning/dataset.py:62
↓ 1 callersClassMossTTSSFTDataset
moss_tts_local/finetuning/dataset.py:59
↓ 1 callersClassMossTTSSFTDataset
moss_tts_delay/finetuning/dataset.py:59
↓ 1 callersClassMyModelLogger
moss_soundeffect_v2/finetuning/finetuning.py:165
↓ 1 callersClassNumpyLMHeads
Compute logits from hidden state for all 33 prediction heads (pure NumPy).
moss_tts_delay/llama_cpp/lm_heads.py:24
↓ 1 callersClassPackedSequenceMetadata
moss_tts_local_v1.5/gpt2_decoder.py:28
↓ 1 callersClassPipelineUnitRunner
moss_soundeffect_v2/diffsynth/utils/__init__.py:180
↓ 1 callersClassQwen3TextEncoder
Wraps Qwen3 (decoder-only) as a text encoder for Wan audio pipeline. Loads the full Qwen3 model and extracts last-layer hidden states as text
moss_soundeffect_v2/diffsynth/models/qwen3_text_encoder.py:6
↓ 1 callersClassResidualBlock
moss_soundeffect_v2/diffsynth/models/wan_video_camera_controller.py:63
↓ 1 callersClassResidualVectorQuantize
Introduced in SoundStream: An end2end neural audio codec https://arxiv.org/abs/2107.03312
moss_soundeffect_v2/diffsynth/models/dac_vae.py:424
next →1–100 of 178, ranked by callers