Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/Audio-AGI/AudioSep
/ types & classes
Types & classes
62 in github.com/Audio-AGI/AudioSep
⨍
Functions
370
◇
Types & classes
62
↓ 12 callers
Class
ConvBlock
models/CLAP/open_clip/pann_model.py:33
↓ 7 callers
Class
EncoderBlockRes1B
models/resunet.py:168
↓ 6 callers
Class
DecoderBlockRes1B
models/resunet.py:201
↓ 6 callers
Class
MLPLayers
models/CLAP/open_clip/model.py:27
↓ 5 callers
Class
LayerNorm
Subclass torch's LayerNorm to handle fp16.
models/CLAP/open_clip/model.py:244
↓ 4 callers
Class
AFF
多特征融合 AFF
models/CLAP/open_clip/feature_fusion.py:133
↓ 4 callers
Class
CLAP_Encoder
models/clap_encoder.py:10
↓ 4 callers
Class
ConvBlock5x5
models/CLAP/open_clip/pann_model.py:86
↓ 4 callers
Class
DAF
直接相加 DirectAddFuse
models/CLAP/open_clip/feature_fusion.py:11
↓ 4 callers
Class
DataInfo
models/CLAP/training/data.py:248
↓ 4 callers
Class
iAFF
多特征融合 iAFF
models/CLAP/open_clip/feature_fusion.py:23
↓ 3 callers
Class
AverageMeter
Computes and stores the average and current value
models/CLAP/training/train.py:22
↓ 3 callers
Class
AverageMeter
Computes and stores the average and current value
models/CLAP/training/lp_train.py:23
↓ 3 callers
Class
HTSAT_Swin_Transformer
r"""HTSAT based on the Swin Transformer Args: spec_size (int | tuple(int)): Input Spectrogram size. Default 256 patch_size (int |
models/CLAP/open_clip/htsat.py:779
↓ 2 callers
Class
Bottleneck
models/CLAP/open_clip/model.py:47
↓ 2 callers
Class
CLAP
models/CLAP/open_clip/model.py:422
↓ 2 callers
Class
CLAPAudioCfp
models/CLAP/open_clip/model.py:397
↓ 2 callers
Class
CLAPTextCfg
models/CLAP/open_clip/model.py:413
↓ 2 callers
Class
ConvBlockRes
models/resunet.py:84
↓ 2 callers
Class
Mlp
MLP as used in Vision Transformer, MLP-Mixer and related networks
models/CLAP/open_clip/htsat.py:204
↓ 2 callers
Class
Transformer
models/CLAP/open_clip/model.py:285
↓ 1 callers
Class
AttentionPool2d
models/CLAP/open_clip/model.py:106
↓ 1 callers
Class
AudioCapsEvaluator
evaluation/evaluate_audiocaps.py:26
↓ 1 callers
Class
AudioSep
models/audiosep.py:14
↓ 1 callers
Class
AudioSetEvaluator
evaluation/evaluate_audioset.py:36
↓ 1 callers
Class
AudioTextDataset
Can sample data from audio-text databases Params: sampling_rate: audio sampling rate max_clip_len: max length (seconds) of audio clip to b
data/audiotext_dataset.py:8
↓ 1 callers
Class
BasicLayer
A basic Swin Transformer layer for one stage. Args: dim (int): Number of input channels. input_resolution (tuple[int]): Input reso
models/CLAP/open_clip/htsat.py:682
↓ 1 callers
Class
CheckpointEveryNSteps
callbacks/base.py:6
↓ 1 callers
Class
ClipLoss
models/CLAP/open_clip/loss.py:125
↓ 1 callers
Class
ClothoEvaluator
evaluation/evaluate_clotho.py:26
↓ 1 callers
Class
CsvDataset
models/CLAP/training/data.py:228
↓ 1 callers
Class
DataModule
data/datamodules.py:8
↓ 1 callers
Class
DropPath
Drop paths (Stochastic Depth) per sample (when applied in main path of residual blocks).
models/CLAP/open_clip/htsat.py:66
↓ 1 callers
Class
ESC50Evaluator
evaluation/evaluate_esc50.py:26
↓ 1 callers
Class
FiLM
models/resunet.py:10
↓ 1 callers
Class
LPLoss
models/CLAP/open_clip/loss.py:384
↓ 1 callers
Class
LPMetrics
models/CLAP/open_clip/loss.py:355
↓ 1 callers
Class
LinearProbe
models/CLAP/open_clip/linear_probe.py:7
↓ 1 callers
Class
MUSICEvaluator
evaluation/evaluate_music.py:26
↓ 1 callers
Class
PatchEmbed
2D Image to Patch Embedding
models/CLAP/open_clip/htsat.py:77
↓ 1 callers
Class
ResUNet30_Base
models/resunet.py:267
↓ 1 callers
Class
ResidualAttentionBlock
models/CLAP/open_clip/model.py:259
↓ 1 callers
Class
SegmentMixer
data/waveform_mixers.py:9
↓ 1 callers
Class
SimpleTokenizer
models/CLAP/open_clip/tokenizer.py:74
↓ 1 callers
Class
SwinTransformerBlock
r"""Swin Transformer Block. Args: dim (int): Number of input channels. input_resolution (tuple[int]): Input resolution. nu
models/CLAP/open_clip/htsat.py:468
↓ 1 callers
Class
ToyDataset
models/CLAP/training/data.py:81
↓ 1 callers
Class
VGGSoundEvaluator
evaluation/evaluate_vggsound.py:26
↓ 1 callers
Class
WindowAttention
r"""Window based multi-head self attention (W-MSA) module with relative position bias. It supports both of shifted and non-shifted window. Arg
models/CLAP/open_clip/htsat.py:352
Class
AttBlock
models/CLAP/open_clip/pann_model.py:126
Class
Base
models/base.py:75
Class
CLAPVisionCfg
models/CLAP/open_clip/model.py:376
Class
Cnn10
models/CLAP/open_clip/pann_model.py:556
Class
Cnn14
models/CLAP/open_clip/pann_model.py:171
Class
Cnn6
models/CLAP/open_clip/pann_model.py:429
Class
ModifiedResNet
A ResNet class that is similar to torchvision's but contains the following changes: - There are now 3 "stem" convolutions as opposed to 1, wi
models/CLAP/open_clip/model.py:153
Class
PatchMerging
r"""Patch Merging Layer. Args: input_resolution (tuple[int]): Resolution of input feature. dim (int): Number of input channels.
models/CLAP/open_clip/htsat.py:640
Class
Predictor
predict.py:10
Class
QuickGELU
models/CLAP/open_clip/model.py:253
Class
ResUNet30
models/resunet.py:621
Class
StatisticsContainer
utils.py:203
Class
TimmModel
timm model adapter # FIXME this adapter is a work in progress, may change in ways that break weight compat
models/CLAP/open_clip/timm_model.py:22
Class
VisualTransformer
models/CLAP/open_clip/model.py:305