MCPcopy Create free account

hub / github.com/devinxzhang/MFuser / types & classes

Types & classes269 in github.com/devinxzhang/MFuser

↓ 6 callersClassLayerNorm
Subclass torch's LayerNorm to handle fp16.
models/backbones/clip/models.py:16
↓ 5 callersClassCompose
Compose multiple transforms sequentially. Args: transforms (Sequence[dict | callable]): Sequence of transform object or confi
mmseg/datasets/pipelines/compose.py:11
↓ 5 callersClassLayerScale
models/backbones/eva_clip/transformer.py:70
↓ 4 callersClassAssignResult
Collection of assign results.
mmseg/models/utils/assigner.py:15
↓ 4 callersClassBlock
mmseg/models/backbones/mix_transformer.py:108
↓ 4 callersClassMVFuser
models/backbones/eva_clip/adapter_module.py:60
↓ 4 callersClassOverlapPatchEmbed
Image to Patch Embedding.
mmseg/models/backbones/mix_transformer.py:151
↓ 4 callersClassSelfAttentionBlock
Self-Attention Module. Args: in_channels (int): Input channels of key/query feature. channels (int): Output channels of key/query
mmseg/models/decode_heads/isa_head.py:16
↓ 4 callersClassVGGDecoder
mmseg/models/uda/vgg.py:190
↓ 4 callersClassVGGEncoder
mmseg/models/uda/vgg.py:8
↓ 3 callersClassCLIP
models/backbones/eva_clip/model.py:214
↓ 3 callersClassDinoVisionTransformer
models/backbones/dino_v2.py:56
↓ 3 callersClassDropPath
Drop paths (Stochastic Depth) per sample (when applied in main path of residual blocks).
models/backbones/dino_layers/drop_path.py:26
↓ 3 callersClassResLayer
ResLayer to build ResNet style backbone. Args: block (nn.Module): block used to build ResLayer. inplanes (int): inplanes of block
mmseg/models/utils/res_layer.py:8
↓ 3 callersClassTransformer
models/backbones/clip/models.py:68
↓ 3 callersClassUpsample
mmseg/models/utils/wrappers.py:30
↓ 2 callersClassASPPModule
Atrous Spatial Pyramid Pooling (ASPP) Module. Args: dilations (tuple[int]): Dilation rate of each layer. in_channels (int): Input
mmseg/models/decode_heads/aspp_head.py:12
↓ 2 callersClassASPPWrapper
mmseg/models/decode_heads/daformer_head.py:14
↓ 2 callersClassAdaptivePadding
Applies padding to input (if needed) so that input can get fully covered by filter you specified. It support two modes "same" and "corner". The
mmseg/models/utils/embed.py:25
↓ 2 callersClassAdaptivePadding
Applies padding adaptively to the input. This module can make input get fully covered by filter you specified. It support two modes "same" an
mmseg/models/plugins/transformerlayers.py:64
↓ 2 callersClassBottleneck
models/backbones/eva_clip/modified_resnet.py:10
↓ 2 callersClassCLIPTextCfg
models/backbones/eva_clip/model.py:67
↓ 2 callersClassCLIPVisionCfg
models/backbones/eva_clip/model.py:37
↓ 2 callersClassConcatDataset
A wrapper of concatenated dataset. Same as :obj:`torch.utils.data.dataset.ConcatDataset`, but concat the group flag for image aspect ratio.
mmseg/datasets/dataset_wrappers.py:9
↓ 2 callersClassCustomCLIP
models/backbones/eva_clip/model.py:275
↓ 2 callersClassLayerScale
models/backbones/dino_layers/layer_scale.py:15
↓ 2 callersClassLoadAnnotations
Load annotations for semantic segmentation. Args: reduce_zero_label (bool): Whether reduce all label value by 1. Usually used
mmseg/datasets/pipelines/loading.py:92
↓ 2 callersClassMLP
Linear Embedding.
mmseg/models/decode_heads/segformer_head.py:18
↓ 2 callersClassMlvlPointGenerator
Standard points generator for multi-level (Mlvl) feature maps in 2D points-based detectors. Args: strides (list[int] | list[tuple[int
mmseg/core/anchor/point_generator.py:43
↓ 2 callersClassPPM
Pooling Pyramid Module used in PSPNet. Args: pool_scales (tuple[int]): Pooling scales used in Pooling Pyramid Module.
mmseg/models/decode_heads/psp_head.py:12
↓ 2 callersClassPatchDropout
https://arxiv.org/abs/2212.00794
models/backbones/eva_clip/transformer.py:79
↓ 2 callersClassSiglipEncoder
models/backbones/siglip/modeling_siglip.py:730
↓ 2 callersClassSiglipMLP
models/backbones/siglip/modeling_siglip.py:676
↓ 2 callersClassToTensor
Convert some results to :obj:`torch.Tensor` by given keys. Args: keys (Sequence[str]): Keys that need to be converted to Tensor.
mmseg/datasets/pipelines/formating.py:39
↓ 2 callersClassTransformer
models/backbones/eva_clip/transformer.py:489
↓ 1 callersClassAdaptivePadding
Applies padding to input (if needed) so that input can get fully covered by filter you specified. It support two modes "same" and "corner". The
mmseg/models/utils/transformer.py:37
↓ 1 callersClassAttention
mmseg/models/backbones/mix_transformer.py:47
↓ 1 callersClassAttention
models/backbones/clip/models.py:80
↓ 1 callersClassAttention
models/backbones/eva_clip/transformer.py:154
↓ 1 callersClassAttention
models/backbones/eva_clip/eva_vit_model.py:110
↓ 1 callersClassAttentionPool2d
models/backbones/eva_clip/modified_resnet.py:58
↓ 1 callersClassBlock
models/backbones/eva_clip/eva_vit_model.py:249
↓ 1 callersClassBlockChunk
models/backbones/dino_v2.py:48
↓ 1 callersClassCAM
Channel Attention Module (CAM)
mmseg/models/decode_heads/da_head.py:52
↓ 1 callersClassCustomAttention
models/backbones/eva_clip/transformer.py:247
↓ 1 callersClassCustomResidualAttentionBlock
models/backbones/eva_clip/transformer.py:343
↓ 1 callersClassDWConv
mmseg/models/backbones/mix_transformer.py:440
↓ 1 callersClassDepthwiseSeparableASPPModule
Atrous Spatial Pyramid Pooling (ASPP) Module with depthwise separable conv.
mmseg/models/decode_heads/sep_aspp_head.py:12
↓ 1 callersClassDistributedDataParallelWrapper
A DistributedDataParallel wrapper for models in MMGeneration. In MMedting, there is a need to wrap different modules in the models with separ
mmseg/core/ddp_wrapper.py:11
↓ 1 callersClassDropPath
Drop paths (Stochastic Depth) per sample (when applied in main path of residual blocks).
models/backbones/clip/models.py:29
↓ 1 callersClassDropPath
Drop paths (Stochastic Depth) per sample (when applied in main path of residual blocks).
models/backbones/eva_clip/eva_vit_model.py:38
↓ 1 callersClassEVAVisionTransformer
Vision Transformer with support for patch or hybrid CNN input stage
models/backbones/eva_clip/eva_vit_model.py:370
↓ 1 callersClassFFN
Implements feed-forward networks (FFNs) with identity connection. Args: embed_dims (int): The feature dimension. Same as `Mult
mmseg/models/utils/transformer.py:255
↓ 1 callersClassFlatFolderDataset
mmseg/models/uda/photo_wct_batch.py:22
↓ 1 callersClassHFTextEncoder
HuggingFace model adapter
models/backbones/eva_clip/hf_model.py:75
↓ 1 callersClassHFTokenizer
HuggingFace tokenizer wrapper
models/backbones/eva_clip/tokenizer.py:188
↓ 1 callersClassISALayer
mmseg/models/decode_heads/isa_head.py:67
↓ 1 callersClassInfiniteSamplerWrapper
mmseg/models/uda/sampler.py:18
↓ 1 callersClassLoadImage
A simple pipeline to load image.
mmseg/apis/inference.py:57
↓ 1 callersClassMTEnhancer
models/backbones/clip/models.py:116
↓ 1 callersClassMaskSamplingResult
Mask sampling result.
mmseg/core/box/samplers/mask_sampling_result.py:10
↓ 1 callersClassMlp
mmseg/models/backbones/mix_transformer.py:20
↓ 1 callersClassMlp
models/backbones/dino_layers/mlp.py:16
↓ 1 callersClassMlp
models/backbones/eva_clip/eva_vit_model.py:51
↓ 1 callersClassModifiedResNet
A ResNet class that is similar to torchvision's but contains the following changes: - There are now 3 "stem" convolutions as opposed to 1, wi
models/backbones/eva_clip/modified_resnet.py:95
↓ 1 callersClassMultiheadAttention
A wrapper for ``torch.nn.MultiheadAttention``. This module implements MultiheadAttention with identity connection, and positional encoding i
mmseg/models/plugins/transformerlayers.py:408
↓ 1 callersClassNormalize
Normalize the image. Added key is "img_norm_cfg". Args: mean (sequence): Mean values of 3 channels. std (sequence): Std valu
mmseg/datasets/pipelines/transforms.py:368
↓ 1 callersClassPAM
Position Attention Module (PAM) Args: in_channels (int): Input channels of key/query feature. channels (int): Output channels of
mmseg/models/decode_heads/da_head.py:15
↓ 1 callersClassPatchEmbed
Image to Patch Embedding. We use a conv layer to implement PatchEmbed. Args: in_channels (int): The num of input channels. Default:
mmseg/models/utils/embed.py:96
↓ 1 callersClassPatchEmbed
Image to Patch Embedding
models/backbones/eva_clip/eva_vit_model.py:307
↓ 1 callersClassPhotoWCT
mmseg/models/uda/photo_wct_batch.py:61
↓ 1 callersClassQuickGELU
models/backbones/clip/models.py:24
↓ 1 callersClassRSoftmax
Radix Softmax module in ``SplitAttentionConv2d``. Args: radix (int): Radix of input. groups (int): Groups of input.
mmseg/models/backbones/resnest.py:17
↓ 1 callersClassRelativePositionBias
models/backbones/eva_clip/eva_vit_model.py:333
↓ 1 callersClassRepeatDataset
A wrapper of repeated dataset. The length of repeated dataset will be `times` larger than the original dataset. This is useful when the data
mmseg/datasets/dataset_wrappers.py:26
↓ 1 callersClassResidualAttentionBlock
models/backbones/clip/models.py:42
↓ 1 callersClassResidualAttentionBlock
models/backbones/eva_clip/transformer.py:447
↓ 1 callersClassResize
Resize images & seg. This transform resizes the input image to some scale. If the input dict contains the key "scale", then the scale in the
mmseg/datasets/pipelines/transforms.py:12
↓ 1 callersClassResizeMaxSize
models/backbones/eva_clip/transform.py:13
↓ 1 callersClassSELayer
Squeeze-and-Excitation Module. Args: channels (int): The input (and output) channels of the SE layer. ratio (int): Squeeze ratio
mmseg/models/utils/se_layer.py:9
↓ 1 callersClassSamplingResult
Bbox sampling result. Example: >>> # xdoctest: +IGNORE_WANT >>> from mmdet.core.bbox.samplers.sampling_result import * # NOQA
mmseg/core/box/samplers/sampling_result.py:6
↓ 1 callersClassSiglipAttention
Multi-headed attention from 'Attention Is All You Need' paper
models/backbones/siglip/modeling_siglip.py:466
↓ 1 callersClassSiglipConfig
r""" [`SiglipConfig`] is the configuration class to store the configuration of a [`SiglipModel`]. It is used to instantiate a Siglip model acc
models/backbones/siglip/configuration_siglip.py:228
↓ 1 callersClassSiglipEncoderLayer
models/backbones/siglip/modeling_siglip.py:690
↓ 1 callersClassSiglipImageProcessor
r""" Constructs a SigLIP image processor. Args: do_resize (`bool`, *optional*, defaults to `True`): Whether to resize the
models/backbones/siglip/image_processing_siglip.py:48
↓ 1 callersClassSiglipMultiheadAttentionPoolingHead
Multihead Attention Pooling.
models/backbones/siglip/modeling_siglip.py:1067
↓ 1 callersClassSiglipProcessor
r""" Constructs a Siglip processor which wraps a Siglip image processor and a Siglip tokenizer into a single processor. [`SiglipProcessor`] o
models/backbones/siglip/processing_siglip.py:28
↓ 1 callersClassSiglipTextConfig
r""" This is the configuration class to store the configuration of a [`SiglipTextModel`]. It is used to instantiate a Siglip text encoder acco
models/backbones/siglip/configuration_siglip.py:27
↓ 1 callersClassSiglipTextEmbeddings
models/backbones/siglip/modeling_siglip.py:413
↓ 1 callersClassSiglipTokenizer
Construct a Siglip tokenizer. Based on [SentencePiece](https://github.com/google/sentencepiece). This tokenizer inherits from [`PreTrainedTo
models/backbones/siglip/tokenization_siglip.py:44
↓ 1 callersClassSiglipVisionConfig
r""" This is the configuration class to store the configuration of a [`SiglipVisionModel`]. It is used to instantiate a Siglip vision encoder
models/backbones/siglip/configuration_siglip.py:132
↓ 1 callersClassSiglipVisionEmbeddings
models/backbones/siglip/modeling_siglip.py:351
↓ 1 callersClassSimpleTokenizer
models/backbones/utils.py:62
↓ 1 callersClassSimpleTokenizer
models/backbones/eva_clip/tokenizer.py:72
↓ 1 callersClassSoftAttnMaskAttention
mmseg/models/plugins/transformerlayers.py:884
↓ 1 callersClassSplitAttentionConv2d
Split-Attention Conv2d in ResNeSt. Args: in_channels (int): Same as nn.Conv2d. out_channels (int): Same as nn.Conv2d. ker
mmseg/models/backbones/resnest.py:41
↓ 1 callersClassSwiGLU
models/backbones/eva_clip/eva_vit_model.py:85
↓ 1 callersClassTextTransformer
models/backbones/eva_clip/transformer.py:646
↓ 1 callersClassTimmModel
timm model adapter # FIXME this adapter is a work in progress, may change in ways that break weight compat
models/backbones/eva_clip/timm_model.py:28
↓ 1 callersClassTransformerEncoderLayer
Implements one encoder layer in Vision Transformer. Args: embed_dims (int): The feature dimension. num_heads (int): Parallel atte
mmseg/models/backbones/vit.py:27
next →1–100 of 269, ranked by callers