Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/Stability-AI/stable-audio-tools
/ types & classes
Types & classes
277 in github.com/Stability-AI/stable-audio-tools
⨍
Functions
1,182
◇
Types & classes
277
↓ 15 callers
Class
ResidualUnit
stable_audio_tools/models/blocks.py:42
↓ 14 callers
Class
Transpose
stable_audio_tools/models/autoencoders.py:102
↓ 12 callers
Class
ValueLoss
stable_audio_tools/training/losses/losses.py:28
↓ 8 callers
Class
ResnetBlock1d
stable_audio_tools/models/adp.py:276
↓ 7 callers
Class
AuralossLoss
stable_audio_tools/training/losses/losses.py:109
↓ 7 callers
Class
Conv1d
stable_audio_tools/models/adp.py:126
↓ 6 callers
Class
EMA
Implements exponential moving average shadowing for your model. Utilizes an inverse decay schedule to manage longer term training runs.
stable_audio_tools/training/ema.py:21
↓ 6 callers
Class
MSELoss
stable_audio_tools/training/losses/losses.py:68
↓ 6 callers
Class
SelfAttention1d
stable_audio_tools/models/blocks.py:85
↓ 6 callers
Class
TransformerBlock
stable_audio_tools/models/adp.py:546
↓ 6 callers
Class
_ConvBlock
stable_audio_tools/training/metrics/fad_metrics.py:217
↓ 4 callers
Class
L1Loss
stable_audio_tools/training/losses/losses.py:49
↓ 4 callers
Class
LayerScale
stable_audio_tools/models/transformer.py:410
↓ 4 callers
Class
MultiLoss
stable_audio_tools/training/losses/losses.py:117
↓ 4 callers
Class
NormConv2d
Wrapper around Conv2d and normalization applied to this conv to provide a uniform interface across normalization approaches.
stable_audio_tools/models/encodec.py:19
↓ 4 callers
Class
Pattern
Base implementation of a pattern over a sequence with multiple codebooks. The codebook pattern consists in a layout, defining for each sequence s
stable_audio_tools/models/codebook_patterns.py:19
↓ 4 callers
Class
RMSNorm
stable_audio_tools/models/blocks.py:359
↓ 4 callers
Class
StaggeredLogger
Accumulates log values over N steps and flushes averaged metrics. Avoids per-step CUDA syncs (.item()) and prevents PL from caching stale val
stable_audio_tools/training/utils.py:183
↓ 4 callers
Class
TransformerDiscriminator
stable_audio_tools/models/discriminators.py:1382
↓ 4 callers
Class
TransformerResamplingBlock
stable_audio_tools/models/autoencoders.py:117
↓ 3 callers
Class
ContinuousTransformer
stable_audio_tools/models/transformer.py:1066
↓ 3 callers
Class
DiffusionTransformer
stable_audio_tools/models/dit.py:13
↓ 3 callers
Class
FourierFeatures
stable_audio_tools/models/blocks.py:135
↓ 3 callers
Class
LogSNRShift
Adaptive log-SNR distribution shift. Maps t∈[0,1] to log-SNR-spaced values while preserving order (0→0, 1→1). Equivalent to applying: logsnr
stable_audio_tools/inference/sampling.py:162
↓ 3 callers
Class
LossWithTarget
stable_audio_tools/training/losses/losses.py:95
↓ 3 callers
Class
PQMF
Pseudo Quadrature Mirror Filter (PQMF) for multiband signal decomposition and reconstruction. Uses polyphase representation which is computat
stable_audio_tools/models/pqmf.py:9
↓ 3 callers
Class
PsychoacousticStereoNoise
Psychoacoustic noise generator that works directly in frequency domain to avoid filterbank reconstruction artifacts
stable_audio_tools/models/psychoacoustics.py:63
↓ 3 callers
Class
RotaryEmbedding
stable_audio_tools/models/transformer.py:239
↓ 3 callers
Class
Transformer1d
stable_audio_tools/models/adp.py:588
↓ 3 callers
Class
UNet1d
stable_audio_tools/models/adp.py:987
↓ 3 callers
Class
WaveletPretransform
stable_audio_tools/models/pretransforms.py:455
↓ 2 callers
Class
AbsolutePositionalEmbedding
stable_audio_tools/models/transformer.py:194
↓ 2 callers
Class
Attention
stable_audio_tools/models/transformer.py:521
↓ 2 callers
Class
Attention
stable_audio_tools/models/adp.py:476
↓ 2 callers
Class
BrownianTreeNoiseSampler
A noise sampler backed by a torchsde.BrownianTree. Args: x (Tensor): The tensor whose shape, device and dtype to use to generate
stable_audio_tools/inference/k_diffusion/sampling.py:73
↓ 2 callers
Class
ConvBlock1d
stable_audio_tools/models/adp.py:214
↓ 2 callers
Class
ConvNeXtBlock
stable_audio_tools/models/convnext.py:16
↓ 2 callers
Class
DACGANLoss
Computes a discriminator loss, given a discriminator on generated waveforms/spectrograms compared to ground truth waveforms/spectrograms.
stable_audio_tools/models/discriminators.py:948
↓ 2 callers
Class
DPMSolver
DPM-Solver. See https://arxiv.org/abs/2206.00927.
stable_audio_tools/inference/k_diffusion/sampling.py:220
↓ 2 callers
Class
DiTWrapper
stable_audio_tools/models/diffusion.py:563
↓ 2 callers
Class
DiffusionAttnUnet1D
stable_audio_tools/models/diffusion.py:449
↓ 2 callers
Class
DistributionShift
stable_audio_tools/inference/sampling.py:113
↓ 2 callers
Class
DynamicTanh
stable_audio_tools/models/transformer.py:324
↓ 2 callers
Class
ExpoFourierFeatures
stable_audio_tools/models/blocks.py:145
↓ 2 callers
Class
FluxDistributionShift
Flux/SD3/Self-Flow timestep shift: t_shifted = alpha * t / (1 + (alpha-1) * t). Convention: t=0 is data, t=1 is noise. alpha > 1 shifts times
stable_audio_tools/inference/sampling.py:40
↓ 2 callers
Class
GLU
stable_audio_tools/models/transformer.py:419
↓ 2 callers
Class
IdentityDistributionShift
No-op distribution shift — returns timesteps unchanged.
stable_audio_tools/inference/sampling.py:34
↓ 2 callers
Class
LayerNorm
stable_audio_tools/models/transformer.py:362
↓ 2 callers
Class
Mono
stable_audio_tools/data/utils.py:135
↓ 2 callers
Class
MultiConditioner
A module that applies multiple conditioners to an input dictionary based on the keys Args: conditioners: a dictionary of conditioner
stable_audio_tools/models/conditioners.py:1066
↓ 2 callers
Class
MultiFilterBankDiscriminator
stable_audio_tools/models/discriminators.py:1169
↓ 2 callers
Class
MultiScaleSTFTDiscriminator
Multi-Scale STFT (MS-STFT) discriminator. Args: filters (int): Number of filters in convolutions in_channels (int): Number of inpu
stable_audio_tools/models/encodec.py:108
↓ 2 callers
Class
NumberEmbedder
stable_audio_tools/models/adp.py:1456
↓ 2 callers
Class
PadCrop_Normalized_T
stable_audio_tools/data/utils.py:24
↓ 2 callers
Class
PatchedPretransform
stable_audio_tools/models/pretransforms.py:473
↓ 2 callers
Class
PhaseFlipper
Randomly invert the phase of a signal
stable_audio_tools/data/utils.py:127
↓ 2 callers
Class
RMSNorm
stable_audio_tools/models/transformer.py:390
↓ 2 callers
Class
STFTMagnitudeLoss
STFT magnitude loss module. See [Arik et al., 2018](https://arxiv.org/abs/1808.06719) and [Engel et al., 2020](https://arxiv.org/abs/2001.046
stable_audio_tools/training/losses/auraloss.py:252
↓ 2 callers
Class
SharedDiscriminatorConvNet
stable_audio_tools/models/discriminators.py:270
↓ 2 callers
Class
SnakeBeta
stable_audio_tools/models/blocks.py:385
↓ 2 callers
Class
Stereo
stable_audio_tools/data/utils.py:139
↓ 2 callers
Class
T5GemmaConditioner
stable_audio_tools/models/conditioners.py:542
↓ 2 callers
Class
TAAEBlock
stable_audio_tools/models/autoencoders.py:434
↓ 2 callers
Class
UNet1DCondWrapper
stable_audio_tools/models/diffusion.py:338
↓ 2 callers
Class
UNetCFG1d
UNet1d with Classifier-Free Guidance
stable_audio_tools/models/adp.py:1263
↓ 2 callers
Class
VolumeNorm
Volume normalization and augmentation of a signal [LUFS standard]
stable_audio_tools/data/utils.py:153
↓ 1 callers
Class
ARCTrainingWrapper
Wrapper for ARC post-training on a conditional audio diffusion model.
stable_audio_tools/training/arc.py:93
↓ 1 callers
Class
AttentionBase
stable_audio_tools/models/adp.py:416
↓ 1 callers
Class
AudioAutoencoder
stable_audio_tools/models/autoencoders.py:775
↓ 1 callers
Class
AudioLanguageModel
stable_audio_tools/models/lm.py:35
↓ 1 callers
Class
AudioLanguageModelDemoCallback
stable_audio_tools/training/lm.py:182
↓ 1 callers
Class
AudioLanguageModelTrainingWrapper
stable_audio_tools/training/lm.py:21
↓ 1 callers
Class
AudioLanguageModelWrapper
stable_audio_tools/models/lm.py:141
↓ 1 callers
Class
AudiocraftCompressionPretransform
stable_audio_tools/models/pretransforms.py:628
↓ 1 callers
Class
AutoencoderDemoCallback
stable_audio_tools/training/autoencoders.py:1093
↓ 1 callers
Class
AutoencoderMetricsCallback
FAD metrics for autoencoder training. Compares reconstructed reference audio vs original reference audio using Frechet Audio Distance. Uses t
stable_audio_tools/training/metrics/fad_metrics.py:1173
↓ 1 callers
Class
AutoencoderPretransform
stable_audio_tools/models/pretransforms.py:54
↓ 1 callers
Class
AutoencoderTrainingWrapper
stable_audio_tools/training/autoencoders.py:226
↓ 1 callers
Class
BatchedBrownianTree
A wrapper around torchsde.BrownianTree that enables batches of entropy.
stable_audio_tools/inference/k_diffusion/sampling.py:46
↓ 1 callers
Class
BigVGANDiscriminator
stable_audio_tools/models/discriminators.py:1013
↓ 1 callers
Class
BottleneckBlock1d
stable_audio_tools/models/adp.py:915
↓ 1 callers
Class
CAdamW
Implements Adam algorithm with weight decay fix as introduced in [Decoupled Weight Decay Regularization](https://arxiv.org/abs/1711.05101).
stable_audio_tools/training/optims.py:11
↓ 1 callers
Class
CLAP
stable_audio_tools/models/clap.py:179
↓ 1 callers
Class
CLAPAudioConditioner
stable_audio_tools/models/conditioners.py:362
↓ 1 callers
Class
CLAPLoss
Feature matching loss using CLAP (HTSAT) intermediate layer features. Extracts features from the HTSAT Swin Transformer BasicLayer stages in
stable_audio_tools/training/losses/semantic.py:74
↓ 1 callers
Class
CLAPTextConditioner
stable_audio_tools/models/conditioners.py:266
↓ 1 callers
Class
CLAPTrainingWrapper
Wrapper for training a conditional audio diffusion model.
stable_audio_tools/training/clap.py:163
↓ 1 callers
Class
CLAPValidationCallback
stable_audio_tools/training/clap.py:469
↓ 1 callers
Class
CLion
stable_audio_tools/training/optims.py:137
↓ 1 callers
Class
CausalLMConditioner
stable_audio_tools/models/conditioners.py:656
↓ 1 callers
Class
CepstralLoss
stable_audio_tools/training/losses/auraloss.py:299
↓ 1 callers
Class
ChromaDiscriminator
stable_audio_tools/models/discriminators.py:1108
↓ 1 callers
Class
ChromaPretransform
stable_audio_tools/models/discriminators.py:1481
↓ 1 callers
Class
Cnn14
PANNs CNN14 model for audio embeddings.
stable_audio_tools/training/metrics/fad_metrics.py:238
↓ 1 callers
Class
ComplexSTFTPretransform
stable_audio_tools/models/pretransforms.py:189
↓ 1 callers
Class
ConformerModule
stable_audio_tools/models/transformer.py:818
↓ 1 callers
Class
ContinuousTransformerAudioLMBackbone
stable_audio_tools/models/lm_backbone.py:42
↓ 1 callers
Class
ConvDiscriminator
stable_audio_tools/models/arc.py:20
↓ 1 callers
Class
ConvNeXtDiscriminator
stable_audio_tools/models/arc.py:78
↓ 1 callers
Class
ConvNeXtEncoder
stable_audio_tools/models/convnext.py:85
next →
1–100 of 277, ranked by callers