(self, n_vocab: int, logit_bias: Dict[int, float])
| 825 | llama_cpp.llama_sampler_chain_add(self.sampler, sampler) |
| 826 | |
| 827 | def add_logit_bias(self, n_vocab: int, logit_bias: Dict[int, float]): |
| 828 | # Convert logit_bias dict to C array |
| 829 | bias_array = (llama_cpp.llama_logit_bias * len(logit_bias))() |
| 830 | for i, (token, bias) in enumerate(logit_bias.items()): |
| 831 | bias_array[i].token = token |
| 832 | bias_array[i].bias = bias |
| 833 | |
| 834 | sampler = llama_cpp.llama_sampler_init_logit_bias( |
| 835 | n_vocab, len(logit_bias), bias_array |
| 836 | ) |
| 837 | llama_cpp.llama_sampler_chain_add(self.sampler, sampler) |
| 838 | |
| 839 | def add_infill(self, model: LlamaModel): |
| 840 | sampler = llama_cpp.llama_sampler_init_infill(model.vocab) |
nothing calls this directly
no outgoing calls
no test coverage detected