Methodforward(
ctx,
q1,
q2,
k2,
v2,
key_cache,
value_cache,
vllm_hymeta/attention/fa_kernel_metatoken.py:127
Methodforward(
ctx,
q1,
q2,
k1,
k2,
v1,
v2,
cu_seqlen_q,
vllm_hymeta/attention/fa_kernel_metatoken.py:201
Methodforward(ctx, q, k, v, g, kv_caches, slot_idx, scale=None, initial_state=None, output_final_state=False, reverse=False
vllm_hymeta/model_for_7B/my_fused_recurrent.py:88
Methodget_attn_backend_cls(cls, selected_backend, head_size, dtype,
kv_cache_dtype, block_size, use_v1,
vllm_hymeta/platform.py:21
Functionlayer_norm_ref(x, weight, bias, residual=None, eps=1e-6, prenorm=False, upcast=False)
hf_7B_model/layernorm.py:23
Functionnaive_metatoken_flash_attn(
q1,
q2,
k1,
k2,
v1,
v2,
softmax_scale=None,
num_meta_tokens=128,
sliding
vllm_hymeta/attention/fa_kernel_metatoken.py:372
Functionrms_norm_ref(x, weight, bias, residual=None, eps=1e-6, prenorm=False, upcast=False)
hf_7B_model/layernorm.py:39