MCPcopy Create free account
hub / github.com/OpenImagingLab/FlashVSR / flash_attn_func

Function flash_attn_func

diffsynth/models/stepvideo_text_encoder.py:245–253  ·  view source on GitHub ↗
(q, k, v, dropout_p=0.0, softmax_scale=None, causal=True,
                    return_attn_probs=False, tp_group_rank=0, tp_group_size=1)

Source from the content-addressed store, hash-verified

243
244
245def flash_attn_func(q, k, v, dropout_p=0.0, softmax_scale=None, causal=True,
246 return_attn_probs=False, tp_group_rank=0, tp_group_size=1):
247 softmax_scale = q.size(-1) ** (-0.5) if softmax_scale is None else softmax_scale
248 if hasattr(torch.ops.Optimus, "fwd"):
249 results = torch.ops.Optimus.fwd(q, k, v, None, dropout_p, softmax_scale, causal, return_attn_probs, None, tp_group_rank, tp_group_size)[0]
250 else:
251 warnings.warn("Cannot load `torch.ops.Optimus.fwd`. Using `torch.nn.functional.scaled_dot_product_attention` instead.")
252 results = torch.nn.functional.scaled_dot_product_attention(q.transpose(1, 2), k.transpose(1, 2), v.transpose(1, 2), is_causal=True, scale=softmax_scale).transpose(1, 2)
253 return results
254
255
256class FlashSelfAttention(torch.nn.Module):

Callers 1

forwardMethod · 0.85

Calls

no outgoing calls

Tested by

no test coverage detected