↓ 3 callersMethod__init__(self, params, lr=0.02, weight_decay=0, momentum=0.95, ns_method="gram")
deepspeed/runtime/zero/muon/original_muon.py:191
↓ 3 callersMethod_mlp_gemm(input, residual, input_bias, weight_interm, weight_out, bias, gamma, beta, eps, pre_layer_norm,
op_builder/npu/inference.py:214
↓ 3 callersMethod_qkv_gemm(inputs, weight, q_scale, bias, gamma, beta, eps, add_bias, q_int8, transpose)
op_builder/npu/inference.py:58