(self, rewards: torch.Tensor)
| 49 | |
| 50 | class FakeRewardModel(torch.nn.Module): |
| 51 | def __init__(self, rewards: torch.Tensor): |
| 52 | super().__init__() |
| 53 | self.register_buffer("fixed_rewards", rewards) |
| 54 | self.use_cache_calls: list[bool | None] = [] |
| 55 | |
| 56 | def forward(self, input_ids, attention_mask=None, use_cache=None): |
| 57 | del attention_mask |