MCPcopy Create free account
hub / github.com/Tiiny-AI/PowerInfer / llm_graph_context

Method llm_graph_context

smallthinker/src/llama-graph.cpp:419–458  ·  view source on GitHub ↗

Source from the content-addressed store, hash-verified

417//
418
419llm_graph_context::llm_graph_context(const llm_graph_params & params) :
420 arch (params.arch),
421 hparams (params.hparams),
422 cparams (params.cparams),
423 ubatch (params.ubatch),
424 n_embd (hparams.n_embd),
425 n_layer (hparams.n_layer),
426 n_rot (hparams.n_rot),
427 n_ctx (cparams.n_ctx),
428 n_head (hparams.n_head()),
429 n_head_kv (hparams.n_head_kv()),
430 n_embd_head_k (hparams.n_embd_head_k),
431 n_embd_k_gqa (hparams.n_embd_k_gqa()),
432 n_embd_head_v (hparams.n_embd_head_v),
433 n_embd_v_gqa (hparams.n_embd_v_gqa()),
434 n_expert (hparams.n_expert),
435 n_expert_used (cparams.warmup ? hparams.n_expert : hparams.n_expert_used),
436 freq_base (cparams.rope_freq_base),
437 freq_scale (cparams.rope_freq_scale),
438 ext_factor (cparams.yarn_ext_factor),
439 attn_factor (cparams.yarn_attn_factor),
440 beta_fast (cparams.yarn_beta_fast),
441 beta_slow (cparams.yarn_beta_slow),
442 norm_eps (hparams.f_norm_eps),
443 norm_rms_eps (hparams.f_norm_rms_eps),
444 n_tokens (ubatch.n_tokens),
445 n_outputs (params.n_outputs),
446 n_ctx_orig (cparams.n_ctx_orig_yarn),
447 pooling_type (cparams.pooling_type),
448 rope_type (hparams.rope_type),
449 ctx0 (params.ctx),
450 sched (params.sched),
451 backend_cpu (params.backend_cpu),
452 cvec (params.cvec),
453 loras (params.loras),
454 mstate (params.mstate),
455 cross (params.cross),
456 cb_func (params.cb),
457 res (std::make_unique<llm_graph_result>()) {
458 }
459
460int64_t llm_graph_context::n_pos_per_embd() const {
461 return hparams.rope_type == LLAMA_ROPE_TYPE_MROPE ? 4 : 1;

Callers

nothing calls this directly

Calls 4

n_headMethod · 0.80
n_head_kvMethod · 0.80
n_embd_k_gqaMethod · 0.80
n_embd_v_gqaMethod · 0.80

Tested by

no test coverage detected