Method__init__(self, d_model=256, d_ffn=1024,
dropout=0.1, activation="relu",
n_levels=4
WeVisionOne/transformer_decoder/dino_decoder.py:173
Method__init__(
self,
d_model,
nhead,
dim_feedforward=2048,
dropout=0.1,
act
WeVisionOne/transformer_decoder/transformer_blocks.py:171
Method__init__(
self,
d_model,
nhead,
dim_feedforward=2048,
dropout=0.1,
act
WeVisionOne/transformer_decoder/transformer_blocks.py:248
Method__init__(self, d_model, nhead, dropout=0.0,
activation="relu", normalize_before=False)
WeVisionOne/transformer_decoder/transformer_blocks.py:376
Method__init__(self, in_features, hidden_features=None, out_features=None, act_layer=nn.SiLU, drop=0.,
norm
WeVisionOne/backbone/eva02/det/vit.py:61
Method__init__(
self,
dim,
pt_seq_len,
ft_seq_len=None,
custom_freqs = None,
WeVisionOne/backbone/eva02/det/utils.py:259
Method__init__(
self,
dim,
pt_seq_len=16,
ft_seq_len=None,
custom_freqs = None,
WeVisionOne/backbone/eva02/det/utils.py:310
Method__init__(self, d_model=256, nhead=8,
num_encoder_layers=6, dim_feedforward=1024, dropout=0.1,
WeVisionOne/pixel_decoder/maskdino_early_fusion.py:27
Method__init__(self,
d_model=256, d_ffn=1024,
dropout=0.1, activation="relu",
WeVisionOne/pixel_decoder/maskdino_early_fusion.py:121
Method__init__(self, d_model=256, nhead=8,
num_encoder_layers=6, dim_feedforward=1024, dropout=0.1,
WeVisionOne/pixel_decoder/maskdino_encoder.py:30
Method__init__(self, v_dim, l_dim, embed_dim, num_heads, dropout=0.1, cfg=None)
WeVisionOne/pixel_decoder/groundingdino/fuse_modules.py:100
Method__init__(
self,
d_model=256,
d_ffn=1024,
dropout=0.1,
activation="relu",
WeVisionOne/pixel_decoder/groundingdino/transformer.py:742
Method__init__(
self,
d_model=256,
d_ffn=1024,
dropout=0.1,
activation="relu",
WeVisionOne/pixel_decoder/groundingdino/transformer.py:806
Method__init__(
self,
d_model,
nhead,
dim_feedforward=2048,
dropout=0.1,
act
WeVisionOne/pixel_decoder/groundingdino/transformer_vanilla.py:72
Methodforward
Input:
- tgt: nq, bs, d_model
- memory: hw, bs, d_model
- pos: hw, bs, d_model
- refpoin
WeVisionOne/transformer_decoder/dino_decoder.py:94
Methodforward(self, srcs, masks, text_dict, pos_embeds, use_ckpt=False)
WeVisionOne/pixel_decoder/maskdino_early_fusion.py:82
Methodforward(self, src, pos, reference_points, spatial_shapes, level_start_index, padding_mask=None)
WeVisionOne/pixel_decoder/maskdino_early_fusion.py:150
Methodforward(self, src, spatial_shapes, level_start_index, valid_ratios, pos=None, padding_mask=None, text_feats=None, use
WeVisionOne/pixel_decoder/maskdino_early_fusion.py:185
Methodforward(self, src, spatial_shapes, level_start_index, valid_ratios, pos=None, padding_mask=None)
WeVisionOne/pixel_decoder/maskdino_encoder.py:125
Methodforward :param query (N, Length_{query}, C) :param reference_points (N, Length_{query}, n_levels, 2), range
WeVisionOne/pixel_decoder/ops/modules/ms_deform_attn.py:82
Methodforward(ctx, value, value_spatial_shapes, value_level_start_index, sampling_locations, attention_weights, im2col_step
WeVisionOne/pixel_decoder/ops/functions/ms_deform_attn_func.py:34
Methodforward_summary_ Args: v (_type_): bs, n_img, dim l (_type_): bs, n_text, dim attention_mask_v (_type_, optional
WeVisionOne/pixel_decoder/groundingdino/fuse_modules.py:146
Methodforward Input: - src: [bs, sum(hi*wi), 256] - pos: pos embed for src. [bs, sum(hi*wi), 256] - spatial_shapes: h,w
WeVisionOne/pixel_decoder/groundingdino/transformer.py:484
Methodforward Input: - tgt: nq, bs, d_model - memory: hw, bs, d_model - pos: hw, bs, d_model - refpoints_un
WeVisionOne/pixel_decoder/groundingdino/transformer.py:636
Methodforward(
self, src, pos, reference_points, spatial_shapes, level_start_index, key_padding_mask=None
)
WeVisionOne/pixel_decoder/groundingdino/transformer.py:783