| 55 | } |
| 56 | |
| 57 | void llama_sampling_cp(llama_sampling_context * src, llama_sampling_context * dst) { |
| 58 | if (dst->grammar) { |
| 59 | llama_grammar_free(dst->grammar); |
| 60 | dst->grammar = nullptr; |
| 61 | } |
| 62 | |
| 63 | if (src->grammar) { |
| 64 | dst->grammar = llama_grammar_copy(src->grammar); |
| 65 | } |
| 66 | |
| 67 | dst->prev = src->prev; |
| 68 | } |
| 69 | |
| 70 | llama_token llama_sampling_last(llama_sampling_context * ctx) { |
| 71 | return ctx->prev.back(); |