↓ 4 callersFunctionrepeat_kv This is the equivalent of torch.repeat_interleave(x, dim=1, repeats=n_rep). The hidden states go from (batch, num_key_value_heads, seqlen, he
emu3/mllm/modeling_emu3.py:276
↓ 1 callersMethod_upad_input(self, query_layer, key_layer, value_layer, attention_mask, query_length)
emu3/mllm/modeling_emu3.py:621
Method__init__(self, dim, max_position_embeddings=2048, base=10000, device=None, scaling_factor=1.0)
emu3/mllm/modeling_emu3.py:165
Method__init__(self, dim, max_position_embeddings=2048, base=10000, device=None, scaling_factor=1.0)
emu3/mllm/modeling_emu3.py:184
Method__init__(
self,
height,
width,
img_token,
eoi_token,
eos_token,
emu3/mllm/utils_emu3.py:21
Method__init__(
self,
in_channel: int,
out_channel: int,
kernel_size: Union[int, Tuple[int,
emu3/tokenizer/modeling_emu3visionvq.py:76
Method__init__(
self,
in_channel: int,
out_channel: int,
kernel_size: Tuple[int, ...] = (3,
emu3/tokenizer/modeling_emu3visionvq.py:395
Method__init__(
self,
in_channel: int,
out_channel: int,
kernel_size: Tuple[int, ...] = (4,
emu3/tokenizer/modeling_emu3visionvq.py:423