| 358 | } |
| 359 | |
| 360 | llama_context::~llama_context() { |
| 361 | if (!model.hparams.no_alloc) { |
| 362 | for (size_t i = 0; i < backend_ptrs.size(); ++i) { |
| 363 | ggml_backend_t backend = backend_ptrs[i]; |
| 364 | ggml_backend_buffer_type_t buft = backend_buft[i]; |
| 365 | |
| 366 | const size_t size_exp = backend_buf_exp_size[i]; |
| 367 | const size_t size_act = ggml_backend_sched_get_buffer_size(sched.get(), backend); |
| 368 | if (size_exp == size_act) { |
| 369 | LLAMA_LOG_DEBUG("%s: %10s compute buffer size is %8.4f MiB, matches expectation of %8.4f MiB\n", |
| 370 | __func__, ggml_backend_buft_name(buft), size_act / (1024.0*1024.0), size_exp / (1024.0*1024.0)); |
| 371 | } else { |
| 372 | LLAMA_LOG_WARN("%s: %10s compute buffer size of %8.4f MiB, does not match expectation of %8.4f MiB\n", |
| 373 | __func__, ggml_backend_buft_name(buft), size_act / (1024.0*1024.0), size_exp / (1024.0*1024.0)); |
| 374 | } |
| 375 | } |
| 376 | } |
| 377 | ggml_opt_free(opt_ctx); |
| 378 | } |
| 379 | |
| 380 | void llama_context::sched_reserve() { |
| 381 | if (!sched_need_reserve) { |
nothing calls this directly
no test coverage detected