↓ 2 callersFunctionrun_flex_attn(
q: Tensor,
k: Tensor,
v: Tensor,
block_mask: BlockMask,
scale: float,
torch_compile:
src/natten/backends/flex.py:139
↓ 1 callersFunction_run_fwd_bwd(fn, q, k, v, cumseq_q, cumseq_kv, max_q, max_kv)
tests/test_varlen_recompile.py:122
↓ 1 callersMethod_test_cutlass_fmha_varlen(
self,
batch,
heads,
head_dim,
head_dim_v,
seqlens_Q_list,
tests/test_fmha_varlen.py:347
↓ 1 callersMethod_test_fmha_module(
self, batch, seqlens_Q, seqlens_KV, num_heads, head_dim, is_causal, atol
)
tests/test_torch_compile.py:310
↓ 1 callersMethod_test_permute_cuda_kernel(
self, B, H, S, D, tile_shape, dilation, flip_dims, eps, dtype, device="cuda"
)
tests/test_token_permute.py:280