(loss: Tensor, layer: nn.Parameter)
| 147 | @autocast(enabled=False) |
| 148 | @beartype |
| 149 | def grad_layer_wrt_loss(loss: Tensor, layer: nn.Parameter): |
| 150 | return torch_grad(outputs=loss, inputs=layer, grad_outputs=torch.ones_like(loss), retain_graph=True)[0].detach() |
| 151 | |
| 152 | |
| 153 | # helper decorators |