↓ 71 callersFunctionmatmul(a, b, mx: Optional[torch.Tensor]=None, rx: Optional[torch.Tensor]=None, my: Optional[torch.Tensor]=None, ry:
rwkv_pip_package/src/rwkv/model.py:127
↓ 4 callersFunctionRWKV_x070_CMix_one(x, x_prev, x_k, K_, V_, semb_, s1_, s2_, s0_)
rwkv_pip_package/src/rwkv/model.py:578
↓ 4 callersFunctionRWKV_x070_TMix_one(layer_id: int, H:int, N:int, x, x_prev, v_first, state, x_r, x_w, x_k, x_v, x_a, x_g, w0, w1, w2, a0, a1, a2,
rwkv_pip_package/src/rwkv/model.py:492
↓ 2 callersFunctionRWKV_x070_CMix_seq(x, x_prev, x_k, K_, V_, semb_, s1_, s2_, s0_)
rwkv_pip_package/src/rwkv/model.py:587
↓ 2 callersFunctionRWKV_x070_TMix_seq(layer_id: int, H:int, N:int, x, x_prev, v_first, state, x_r, x_w, x_k, x_v, x_a, x_g, w0, w1, w2, a0, a1, a2,
rwkv_pip_package/src/rwkv/model.py:520
↓ 2 callersMethodgenerate(self, ctx, token_count=100, args=PIPELINE_ARGS(), callback=None, state=None)
rwkv_pip_package/src/rwkv/utils.py:90
↓ 2 callersMethodv5_2_after(self, t_decay, out, s, x, xxx, g, lx_w, lx_b, ow, omx, orx, omy, ory)
rwkv_pip_package/src/rwkv/model.py:1379
↓ 1 callersMethodRUN_RWKV_5(self, B, T, C, H, state, r, k, v, w, u)
rwkv_pip_package/src/rwkv/model.py:975
↓ 1 callersMethodRUN_RWKV_6(self, B, T, C, H, state, r, k, v, w, u)
rwkv_pip_package/src/rwkv/model.py:978
↓ 1 callersFunctionRWKV7_OP(state, r, w, k, v, a, b)
rwkv_pip_package/src/rwkv/model.py:218
↓ 1 callersMethodchannel_mixing(self, x, state, i:int, time_mix_k, time_mix_r, kw, vw, rw)
RWKV_v5_demo.py:159
↓ 1 callersMethodchannel_mixing(self, x, state, i:int, time_mix_k, time_mix_r, kw, vw, rw)
RWKV_in_150_lines.py:58
↓ 1 callersMethodchannel_mixing(self, x, state, i:int, time_maa_k, time_maa_r, kw, vw, rw)
RWKV_v6_demo.py:157
↓ 1 callersFunctioncuda_mm8_one(N: int, M: int, x, w, mx, rx, my, ry)
rwkv_pip_package/src/rwkv/model.py:76
↓ 1 callersFunctioncuda_mm8_seq(B: int, N: int, M: int, x, w, mx, rx, my, ry)
rwkv_pip_package/src/rwkv/model.py:64
↓ 1 callersFunctioncuda_wkv(T: int, C: int, w, u, k, v, aa, bb, pp)
rwkv_pip_package/src/rwkv/model.py:52
↓ 1 callersFunctionmm8(x: torch.Tensor, w: torch.Tensor, mx: torch.Tensor, rx: torch.Tensor, my: torch.Tensor, ry: torch.Tensor)
rwkv_pip_package/src/rwkv/model.py:122
↓ 1 callersMethodtime_mixing(self, x, state, i:int, time_mix_k, time_mix_v, time_mix_r, time_mix_g, time_first, time_decay, kw, vw, rw, gw
RWKV_v5_demo.py:169
↓ 1 callersMethodtime_mixing(self, x, state, i:int, time_mix_k, time_mix_v, time_mix_r, time_first, time_decay, kw, vw, rw, ow)
RWKV_in_150_lines.py:67
↓ 1 callersMethodtime_mixing(self, x, state, i:int, x_maa, w_maa, k_maa, v_maa, r_maa, g_maa, tm_w1, tm_w2, td_w1, td_w2, time_first, time
RWKV_v6_demo.py:168
↓ 1 callersMethodv5_2_before(self, x, sx, s, ln_w, ln_b, lx_w, lx_b, k_mix, v_mix, r_mix, g_mix, t_decay, t_first, kw, vw, rw, gw, ow, kmx
rwkv_pip_package/src/rwkv/model.py:1363
↓ 1 callersMethodv6_0_before(self, x, sx, s, ln_w, ln_b, lx_w, lx_b, x_maa, w_maa, k_maa, v_maa, r_maa, g_maa, tm_w1, tm_w2, td_w1, td_w2,
rwkv_pip_package/src/rwkv/model.py:1404
MethodFF_one(self, x, state, i:int, time_mix_k, time_mix_r, kw, vw, rw)
src/model_run.py:137
MethodFF_seq(self, x, state, i:int, time_mix_k, time_mix_r, kw, vw, rw)
src/model_run.py:149