MCPcopy Create free account

hub / github.com/Luce-Org/lucebox-hub / functions

Functions2,878 in github.com/Luce-Org/lucebox-hub

↓ 2 callersFunctionappend_resource_rows
(resources: dict)
server/scripts/phase_split_dual_gpu.py:677
↓ 2 callersFunctionapprox_eq
server/test/test_bandit_integration.cpp:46
↓ 2 callersFunctionar_cmd
(cfg, prompt_bin: Path, out_bin: Path, n_gen: int)
server/scripts/profile.py:138
↓ 2 callersFunctionbackend_ipc_payload_transport_name
server/src/common/backend_ipc.cpp:73
↓ 2 callersFunctionbench_prefill
Send a completion request and measure prefill time.
server/scripts/bench_moe_prefill_streaming.py:38
↓ 2 callersFunctionbuild_cached_hot_batched_graph
server/src/common/moe_hybrid_ffn_eval.cpp:697
↓ 2 callersFunctionbuild_compressor_step
server/src/deepseek4/deepseek4_graph.cpp:504
↓ 2 callersFunctionbuild_draft_graph_internal
Build draft graph at a given ctx_len into sg. Does NOT touch sg.alloc. mirror_view: if true, uses a view into mirror->target_feat at slot0. ctx_alloc:
server/src/common/dflash_draft_graph.cpp:31
↓ 2 callersFunctionbuild_gemma4_dense_ffn
Dense GELU-gated FFN (layer 0 / lead dense layers). Gemma4 uses GELU not SiLU: cur = down( gelu(gate(x)) * up(x) )
server/src/gemma4/gemma4_graph.cpp:49
↓ 2 callersFunctionbuild_gemma4_moe_block
MoE block: shared expert (GELU-gated) + routed experts (softmax gating). Gemma4-specific routing: attn_out → rms_norm → scale by 1/sqrt(n_embd) → mul
server/src/gemma4/gemma4_graph.cpp:59
↓ 2 callersFunctionbuild_laguna_layer
server/src/laguna/laguna_target_graph.cpp:892
↓ 2 callersFunctionbuild_laguna_layer_prefn_step
server/src/laguna/laguna_backend.cpp:1939
↓ 2 callersFunctionbuild_markov_chain_graph
One graph: base logits for all n_positions hidden columns (a single lm_head matmul), then for rows [first_corrected, n_positions) the low-rank Markov
server/src/common/dspark_head.cpp:217
↓ 2 callersFunctionbuild_moe_ffn
server/src/deepseek4/deepseek4_graph.cpp:1706
↓ 2 callersFunctionbuild_qwen35moe_ffn
server/src/qwen35moe/qwen35moe_ffn.cpp:66
↓ 2 callersFunctionbuild_qwen35moe_router
server/src/qwen35moe/qwen35moe_ffn.cpp:10
↓ 2 callersFunctionbuild_remote_moe_runtime_from_weights
server/src/common/moe_expert_compute_ipc.cpp:601
↓ 2 callersFunctionbuild_shared_ffn
server/src/deepseek4/deepseek4_graph.cpp:1526
↓ 2 callersFunctionbuild_sigmoid_topk_moe_router
Build a sigmoid top-k MoE router using the node order recognized by ggml-cuda's topk-moe fusion: sigmoid -> reshape -> optional bias add -> argsort_to
server/src/common/moe_router_graph.h:22
↓ 2 callersFunctionbuild_single_layer
Build a single layer of the Qwen3.5-27B model. layer_idx: which of the 64 layers to build (0-based). inp: input activation [hidden, n_tokens] Ret
server/src/qwen35/qwen35_target_graph.cpp:1031
↓ 2 callersFunctionbuild_swiglu_ffn
server/src/qwen35/qwen35_target_graph.cpp:513
↓ 2 callersFunctionbuild_tail_rope_2d
For KV (single head): x is [head_dim, n_tokens]
server/src/deepseek4/deepseek4_graph.cpp:481
↓ 2 callersFunctionbuild_target_multilabel
Convert expert indices to multi-label binary targets.
scripts/train_predictor.py:273
↓ 2 callersFunctionbuild_target_step_tree
server/src/qwen35/graph_builders.cpp:376
↓ 2 callersFunctionbyte_to_gpt2_unicode
Forward GPT-2 byte encoding: raw byte → Unicode codepoint (UTF-8 string). This is the inverse of gpt2_unicode_to_byte (defined later, near decode). By
server/src/server/tokenizer.cpp:317
↓ 2 callersFunctioncase_map
(report: dict[str, Any])
harness/benchmarks/generation_benchmark.py:322
↓ 2 callersFunctionchat_text_and_tools
(chat: dict)
harness/clients/llamacpp_compat_proxy.py:219
↓ 2 callersFunctioncheck_feature_width_compatible
server/src/common/dflash_feature_ring.cpp:61
↓ 2 callersFunctionchecked_mul_size
server/src/common/dflash_draft_ipc.cpp:40
↓ 2 callersFunctionchecked_mul_size
server/src/common/target_shard_ipc.cpp:26
↓ 2 callersFunctionclient_bin
(work_dir: Path, spec: ClientSpec)
harness/client_test_runner.py:277
↓ 2 callersFunctionclient_smoke_env
(work_dir: Path, spec: ClientSpec)
harness/client_test_runner.py:287
↓ 2 callersMethodclose
(self, timeout: float = 5.0)
optimizations/pflash/pflash/dflash_client.py:277
↓ 2 callersMethodclose
(self)
server/tests/test_tokenizer.py:74
↓ 2 callersFunctionclose_expert_mmap
server/src/common/moe_expert_compute_ipc.cpp:544
↓ 2 callersFunctionclose_server_log
(proc: subprocess.Popen)
harness/client_test_runner.py:1075
↓ 2 callersFunctioncommit_shared_payload_response
server/src/common/moe_expert_compute_ipc.cpp:706
↓ 2 callersMethodcompute_auto_split_layers
server/src/deepseek4/deepseek4_layer_split_adapter.cpp:127
↓ 2 callersFunctioncompute_ds4_expert_memory_info
server/src/deepseek4/deepseek4_backend.cpp:144
↓ 2 callersFunctioncontext_overflow_message
server/src/server/http_server.cpp:89
↓ 2 callersFunctioncopy_capture_slice_to_draft_ring
server/src/common/dflash_feature_ring.cpp:367
↓ 2 callersFunctioncopy_capture_slice_to_remote_draft
server/src/common/dflash_draft_ipc.cpp:355
↓ 2 callersFunctioncpu_dot_f16_row
server/src/deepseek4/deepseek4_graph.cpp:1814
↓ 2 callersFunctioncpu_hc_pre_into
server/src/deepseek4/deepseek4_graph.cpp:1947
↓ 2 callersFunctioncpu_matvec_f16
server/src/deepseek4/deepseek4_graph.cpp:1831
↓ 2 callersFunctioncpu_matvec_f16_serial
server/src/deepseek4/deepseek4_graph.cpp:1822
↓ 2 callersFunctioncreate_gemma4_cache
server/src/gemma4/gemma4_loader.cpp:523
↓ 2 callersFunctioncurl_forward
server/src/server/http_server.cpp:239
↓ 2 callersFunctiondaemon_prefix
server/src/common/target_shard_ipc_daemon.cpp:26
↓ 2 callersFunctiondeepseek4_snapshot_restore
server/src/deepseek4/deepseek4_graph.cpp:3698
↓ 2 callersFunctiondeepseek4_snapshot_save
server/src/deepseek4/deepseek4_graph.cpp:3607
↓ 2 callersFunctiondeepseek4_step
server/src/deepseek4/deepseek4_graph.cpp:2659
↓ 2 callersMethoddestroy
server/src/qwen35moe/qwen35moe_pipelined_decode.cpp:208
↓ 2 callersFunctiondraw_from_weights
Draws a token from `cand`, whose .first fields are proportional probabilities (need not already sum to 1 or be sorted). `r_uniform` is a pre-drawn uni
server/src/common/sampler.cpp:66
↓ 2 callersFunctionds4_backend_is_cuda
server/src/deepseek4/deepseek4_graph.cpp:1219
↓ 2 callersFunctionds4_backend_is_hip
server/src/deepseek4/deepseek4_graph.cpp:1212
↓ 2 callersFunctionds4_hc_col_normalize
server/src/deepseek4/deepseek4_graph.cpp:1206
↓ 2 callersFunctionds4_hc_cuda_enabled
server/src/deepseek4/deepseek4_graph.cpp:1992
↓ 2 callersFunctionds4_hc_row_normalize
server/src/deepseek4/deepseek4_graph.cpp:1201
↓ 2 callersFunctionds4_try_gpu_hc_pre_device
server/src/deepseek4/deepseek4_graph.cpp:1270
↓ 2 callersFunctiondspark_fused_usable
Guards shared by the fused Markov paths: head present, usable inputs, and the target lm_head vocab matching the head's training vocab.
server/src/common/dspark_head.cpp:189
↓ 2 callersFunctionelapsed_ms
server/test/bench_moe_stream.cpp:36
↓ 2 callersMethodembed_tokens
server/src/laguna/laguna_dflash_target.cpp:581
↓ 2 callersMethodempty
server/src/common/moe_hybrid_placement.cpp:24
↓ 2 callersFunctionenable_peer_access_one_way
── helpers ─────────────────────────────────────────────────────
server/src/common/peer_access.cpp:13
↓ 2 callersFunctionensure_moe_expert_compute_runtime
server/src/common/moe_expert_compute.cpp:161
↓ 2 callersFunctionenv_flag_enabled
server/src/deepseek4/deepseek4_backend.cpp:31
↓ 2 callersFunctionenv_flag_enabled
server/src/deepseek4/deepseek4_layer_split_adapter.cpp:34
↓ 2 callersFunctionenv_int_or_default
server/src/qwen35moe/qwen35moe_backend.cpp:46
↓ 2 callersFunctionenv_or
server/src/common/spark_corpus.cpp:18
↓ 2 callersMethodeos_chat_id
server/src/server/tokenizer.h:49
↓ 2 callersFunctioneval_ds4_hybrid
server/src/deepseek4/deepseek4_graph.cpp:1537
↓ 2 callersFunctioneval_hit_rate
(logits_np, E, k)
scripts/train_predictor.py:555
↓ 2 callersFunctioneval_moe_hot_only_batched
server/src/common/moe_hybrid_ffn_eval.cpp:1734
↓ 2 callersFunctioneval_moe_hybrid_remote_cold_batched
server/src/common/moe_hybrid_ffn_eval.cpp:1594
↓ 2 callersFunctioneval_threshold_metrics
Compute precision, recall, and per-sample FP rate at a confidence threshold. Returns a dict with keys: precision — of experts predicted ≥
scripts/train_predictor.py:236
↓ 2 callersFunctionfill_policy_device_info
server/src/common/backend_precision.cpp:135
↓ 2 callersFunctionfill_qwen35_kvflash_inputs
server/src/qwen35/layer_split_forward.cpp:24
↓ 2 callersMethodfill_slot_pos
Logical position held by each pool slot, -1 for free blocks. `dst` must hold pool_tokens entries. Lets callers build masks that need POSITION semantic
server/src/common/kvflash_pager.h:357
↓ 2 callersFunctionfind_first_seq
server/src/server/prefix_cache.cpp:70
↓ 2 callersFunctionfind_st
server/src/draft/draft_safetensors_loader.cpp:175
↓ 2 callersFunctionfind_tool_function
server/src/server/http_server.cpp:391
↓ 2 callersFunctionflash_prefill_forward_f16_pascal
server/src/flashprefill.cpp:507
↓ 2 callersFunctionflash_prefill_forward_f16_volta
server/src/flashprefill.cpp:399
↓ 2 callersFunctionfmt_speedup
(value: Any)
harness/benchmarks/generation_benchmark.py:383
↓ 2 callersFunctionforce_chunk_neighborhood
server/src/qwen3/qwen3_drafter.cpp:76
↓ 2 callersFunctionforce_neighborhood
Force chunk and its radius-neighborhood into `forced`.
server/src/qwen3/anchor_scan.cpp:11
↓ 2 callersFunctionfree_port
()
harness/client_test_runner.py:1017
↓ 2 callersFunctionfree_qwen3_snapshot
server/src/qwen3/qwen3_backend.cpp:69
↓ 2 callersFunctiongemma4_align_split_for_kv_sharing
server/src/gemma4/gemma4_layer_split_adapter.cpp:31
↓ 2 callersFunctiongemma4_layer_step_graph_free
server/src/gemma4/gemma4_graph.cpp:453
↓ 2 callersFunctiongemma4_view_2d_slice
Helper: get a 2D slice from a 3D tensor along ne[2] (same as llama.cpp ggml_view_2d_slice).
server/src/gemma4/gemma4_graph.cpp:411
↓ 2 callersFunctiongpu_sampler_supports
Whether geometric_sample_logits_cuda can (and should) handle this config entirely on the GPU. false for top_k>0 or top_p in (0,1) — not because geomet
server/src/common/geometric_sampler_cuda.h:86
↓ 2 callersMethodhandle_compress
server/test/test_server_unit.cpp:2350
↓ 2 callersMethodhas_aux_options
server/src/placement/remote_draft_config.h:15
↓ 2 callersMethodhas_fused_gate_up
server/src/common/moe_hybrid_types.h:78
↓ 2 callersFunctionhc_post_batch
server/src/deepseek4/deepseek4_graph.cpp:2109
↓ 2 callersFunctionhc_pre_auto
server/src/deepseek4/deepseek4_graph.cpp:2000
↓ 2 callersFunctionhc_pre_batch
server/src/deepseek4/deepseek4_graph.cpp:2059
↓ 2 callersMethodinfo
(self)
server/tests/test_tokenizer.py:71
← previousnext →701–800 of 2,878, ranked by callers