(
model: GPT, input_pos: torch.Tensor, x: torch.Tensor, **kwargs: Any
)
| 57 | |
| 58 | |
| 59 | def next_token( |
| 60 | model: GPT, input_pos: torch.Tensor, x: torch.Tensor, **kwargs: Any |
| 61 | ) -> torch.Tensor: |
| 62 | logits = model(x, input_pos) |
| 63 | next = sample(logits, **kwargs) |
| 64 | return next.to(dtype=x.dtype) |
| 65 | |
| 66 | |
| 67 | @torch.inference_mode() |