MCPcopy Create free account

hub / github.com/Audio-AGI/AudioSep / types & classes

Types & classes62 in github.com/Audio-AGI/AudioSep

↓ 12 callersClassConvBlock
models/CLAP/open_clip/pann_model.py:33
↓ 7 callersClassEncoderBlockRes1B
models/resunet.py:168
↓ 6 callersClassDecoderBlockRes1B
models/resunet.py:201
↓ 6 callersClassMLPLayers
models/CLAP/open_clip/model.py:27
↓ 5 callersClassLayerNorm
Subclass torch's LayerNorm to handle fp16.
models/CLAP/open_clip/model.py:244
↓ 4 callersClassAFF
多特征融合 AFF
models/CLAP/open_clip/feature_fusion.py:133
↓ 4 callersClassCLAP_Encoder
models/clap_encoder.py:10
↓ 4 callersClassConvBlock5x5
models/CLAP/open_clip/pann_model.py:86
↓ 4 callersClassDAF
直接相加 DirectAddFuse
models/CLAP/open_clip/feature_fusion.py:11
↓ 4 callersClassDataInfo
models/CLAP/training/data.py:248
↓ 4 callersClassiAFF
多特征融合 iAFF
models/CLAP/open_clip/feature_fusion.py:23
↓ 3 callersClassAverageMeter
Computes and stores the average and current value
models/CLAP/training/train.py:22
↓ 3 callersClassAverageMeter
Computes and stores the average and current value
models/CLAP/training/lp_train.py:23
↓ 3 callersClassHTSAT_Swin_Transformer
r"""HTSAT based on the Swin Transformer Args: spec_size (int | tuple(int)): Input Spectrogram size. Default 256 patch_size (int |
models/CLAP/open_clip/htsat.py:779
↓ 2 callersClassBottleneck
models/CLAP/open_clip/model.py:47
↓ 2 callersClassCLAP
models/CLAP/open_clip/model.py:422
↓ 2 callersClassCLAPAudioCfp
models/CLAP/open_clip/model.py:397
↓ 2 callersClassCLAPTextCfg
models/CLAP/open_clip/model.py:413
↓ 2 callersClassConvBlockRes
models/resunet.py:84
↓ 2 callersClassMlp
MLP as used in Vision Transformer, MLP-Mixer and related networks
models/CLAP/open_clip/htsat.py:204
↓ 2 callersClassTransformer
models/CLAP/open_clip/model.py:285
↓ 1 callersClassAttentionPool2d
models/CLAP/open_clip/model.py:106
↓ 1 callersClassAudioCapsEvaluator
evaluation/evaluate_audiocaps.py:26
↓ 1 callersClassAudioSep
models/audiosep.py:14
↓ 1 callersClassAudioSetEvaluator
evaluation/evaluate_audioset.py:36
↓ 1 callersClassAudioTextDataset
Can sample data from audio-text databases Params: sampling_rate: audio sampling rate max_clip_len: max length (seconds) of audio clip to b
data/audiotext_dataset.py:8
↓ 1 callersClassBasicLayer
A basic Swin Transformer layer for one stage. Args: dim (int): Number of input channels. input_resolution (tuple[int]): Input reso
models/CLAP/open_clip/htsat.py:682
↓ 1 callersClassCheckpointEveryNSteps
callbacks/base.py:6
↓ 1 callersClassClipLoss
models/CLAP/open_clip/loss.py:125
↓ 1 callersClassClothoEvaluator
evaluation/evaluate_clotho.py:26
↓ 1 callersClassCsvDataset
models/CLAP/training/data.py:228
↓ 1 callersClassDataModule
data/datamodules.py:8
↓ 1 callersClassDropPath
Drop paths (Stochastic Depth) per sample (when applied in main path of residual blocks).
models/CLAP/open_clip/htsat.py:66
↓ 1 callersClassESC50Evaluator
evaluation/evaluate_esc50.py:26
↓ 1 callersClassFiLM
models/resunet.py:10
↓ 1 callersClassLPLoss
models/CLAP/open_clip/loss.py:384
↓ 1 callersClassLPMetrics
models/CLAP/open_clip/loss.py:355
↓ 1 callersClassLinearProbe
models/CLAP/open_clip/linear_probe.py:7
↓ 1 callersClassMUSICEvaluator
evaluation/evaluate_music.py:26
↓ 1 callersClassPatchEmbed
2D Image to Patch Embedding
models/CLAP/open_clip/htsat.py:77
↓ 1 callersClassResUNet30_Base
models/resunet.py:267
↓ 1 callersClassResidualAttentionBlock
models/CLAP/open_clip/model.py:259
↓ 1 callersClassSegmentMixer
data/waveform_mixers.py:9
↓ 1 callersClassSimpleTokenizer
models/CLAP/open_clip/tokenizer.py:74
↓ 1 callersClassSwinTransformerBlock
r"""Swin Transformer Block. Args: dim (int): Number of input channels. input_resolution (tuple[int]): Input resolution. nu
models/CLAP/open_clip/htsat.py:468
↓ 1 callersClassToyDataset
models/CLAP/training/data.py:81
↓ 1 callersClassVGGSoundEvaluator
evaluation/evaluate_vggsound.py:26
↓ 1 callersClassWindowAttention
r"""Window based multi-head self attention (W-MSA) module with relative position bias. It supports both of shifted and non-shifted window. Arg
models/CLAP/open_clip/htsat.py:352
ClassAttBlock
models/CLAP/open_clip/pann_model.py:126
ClassBase
models/base.py:75
ClassCLAPVisionCfg
models/CLAP/open_clip/model.py:376
ClassCnn10
models/CLAP/open_clip/pann_model.py:556
ClassCnn14
models/CLAP/open_clip/pann_model.py:171
ClassCnn6
models/CLAP/open_clip/pann_model.py:429
ClassModifiedResNet
A ResNet class that is similar to torchvision's but contains the following changes: - There are now 3 "stem" convolutions as opposed to 1, wi
models/CLAP/open_clip/model.py:153
ClassPatchMerging
r"""Patch Merging Layer. Args: input_resolution (tuple[int]): Resolution of input feature. dim (int): Number of input channels.
models/CLAP/open_clip/htsat.py:640
ClassPredictor
predict.py:10
ClassQuickGELU
models/CLAP/open_clip/model.py:253
ClassResUNet30
models/resunet.py:621
ClassStatisticsContainer
utils.py:203
ClassTimmModel
timm model adapter # FIXME this adapter is a work in progress, may change in ways that break weight compat
models/CLAP/open_clip/timm_model.py:22
ClassVisualTransformer
models/CLAP/open_clip/model.py:305