Functionflash_attn_fn(query, key, value, n_heads, past_key_value=None, softmax_scale=None, attn_bias=None, key_padding_mask=None, i
llava/model/language_model/mpt/attention.py:71
Methodforward(self, x, timesteps, xt, context=None, y=None, **kwargs)
SUPIR/modules/SUPIR_v0.py:499
Methodforward qkv: (batch, seqlen, 3, nheads, headdim) bias: optional, shape broadcastible to (batch, nheads, seqlen, seqlen).
llava/model/language_model/mpt/flash_attn_triton.py:404
Methodforward q: (batch, seqlen_q, nheads, headdim) kv: (batch, seqlen_k, 2, nheads, headdim) bias: optional, shape broadcastib
llava/model/language_model/mpt/flash_attn_triton.py:431
Methodforward q: (batch_size, seqlen_q, nheads, headdim) k, v: (batch_size, seqlen_k, nheads, headdim) bias: optional, shape br
llava/model/language_model/mpt/flash_attn_triton.py:460
Methodforward(self, x, past_key_value=None, attn_bias=None, attention_mask=None, is_causal=True, needs_weights=False)
llava/model/language_model/mpt/attention.py:191
Methodforward(self, x, past_key_value=None, attn_bias=None, attention_mask=None, is_causal=True, needs_weights=False)
llava/model/language_model/mpt/attention.py:245
Methodforward(
self,
x,
emb,
context=None,
skip_time_mix=False,
time_contex
sgm/modules/diffusionmodules/openaimodel.py:87
Methodforward(self, x, timesteps=None, context=None, y=None, **kwargs)
sgm/modules/diffusionmodules/openaimodel.py:1017
Methodforward(
ctx,
run_function,
length_tensors,
length_non_tensors,
tensor_keys,
sgm/modules/diffusionmodules/util.py:79
Methodforward(
self, x: torch.Tensor, t: torch.Tensor, c: dict, control_scale=1, **kwargs
)
sgm/modules/diffusionmodules/wrappers.py:84
Methodforward(
self,
regularization_log,
inputs,
reconstructions,
optimizer_idx,
sgm/modules/autoencoding/losses/__init__.py:154