↓ 2 callersFunctionfused_anything_and_reducescatter(
my_matmul: Callable[
[List[torch.Tensor], int, Callable[[], torch.cuda.Stream]], None
],
xformers/ops/sequence_parallel_fused_ops.py:791
↓ 2 callersFunctionref_attention(q, k, v, attn_bias=None, drop_mask=None, p=0.0, scale=None)
xformers/attn_bias_utils.py:374
↓ 2 callersFunctionref_attention_splitk(
q, k, v, attn_bias, scale=None, split_k=2, dtype=None
)
tests/test_splitk_reference.py:42