↓ 9 callersMethodget_cross_output(self, cap_embed, visual_embed, cap_mask, visual_mask, n_clips)
prj/snps3_vtp/roi_univl/univl/model/univl_video_base.py:224
↓ 9 callersMethodget_cross_output(self, cap_embed, visual_embed, cap_mask, visual_mask, n_clips)
prj/dmae_vtp/roi_univl/univl/model/univl_video_base.py:224
↓ 9 callersMethodget_cross_output(self, cap_embed, visual_embed, cap_mask, visual_mask, n_clips)
prj/base_vtp/roi_univl/univl/model/univl_video_base.py:224
↓ 7 callersMethodget_cross_output(self, cap_embed, visual_embed, cap_mask, visual_mask, n_clips)
prj/cnvid_vtp/roi_univl/univl/model/univl_video_base.py:224
↓ 6 callersMethod__init__(self, in_features, hidden_features=None, out_features=None, act_layer=nn.GELU, drop=0.)
prj/Pink/pink/model/eva_vit.py:53
↓ 6 callersFunctionrepeat_kv This is the equivalent of torch.repeat_interleave(x, dim=1, repeats=n_rep). The hidden states go from (batch, num_key_value_heads, seqlen, he
prj/M2_omni/models/modeling_llama_3d.py:256
↓ 4 callersMethod_calc_img_embeddings :param visual_tokens: B, seq, h :param position_2d_embeddings: B, seq, h :param position_1d_embeddings: B, seq, h :p
antmmf/modules/embeddings/univl_layout_embedding.py:52