Functioninner_sequence_parallel_fused(
seed: int,
kind: str,
step: str,
dims: Tuple[int, ...],
dtype: torch.dtype,
use_comp
tests/test_sequence_parallel_fused_ops.py:117
Functionmem_eff_attention_bw(
shape_q, num_threads: int, attn_bias_cfg, dropout_p, dtype, Hkv=None
)
xformers/benchmarks/benchmark_mem_eff_attention.py:266
Functionmem_eff_attention_fw(
shape_q,
num_threads: int,
attn_bias_cfg,
dropout_p,
dtype,
packed=True,
Hkv=Non
xformers/benchmarks/benchmark_mem_eff_attention.py:168