| 9733 | } |
| 9734 | |
| 9735 | struct llama_model_quantize_params llama_model_quantize_default_params() { |
| 9736 | struct llama_model_quantize_params result = { |
| 9737 | /*.nthread =*/ 0, |
| 9738 | /*.ftype =*/ LLAMA_FTYPE_MOSTLY_Q5_1, |
| 9739 | /*.allow_requantize =*/ false, |
| 9740 | /*.quantize_output_tensor =*/ true, |
| 9741 | /*.only_copy =*/ false, |
| 9742 | /*.pure =*/ false, |
| 9743 | }; |
| 9744 | |
| 9745 | return result; |
| 9746 | } |
| 9747 | |
| 9748 | int llama_max_devices(void) { |
| 9749 | return LLAMA_MAX_DEVICES; |