MCPcopy Create free account

hub / github.com/Luce-Org/lucebox-hub / functions

Functions2,878 in github.com/Luce-Org/lucebox-hub

↓ 3 callersFunctionis_mark
server/src/server/tokenizer.cpp:111
↓ 3 callersMethodis_resident
server/src/common/kvflash_pager.h:311
↓ 3 callersFunctionjson_array_size
server/src/server/http_server.cpp:377
↓ 3 callersFunctionkv_cache_bytes
server/test/test_kvflash.cpp:54
↓ 3 callersFunctionlaguna_is_full_attn_layer
True if layer `il` uses full attention (the FIRST layer in each group of `swa_pattern` is full; the remaining are sliding-window).
server/src/laguna/laguna_internal.h:143
↓ 3 callersFunctionlaguna_sampled_verify_enabled
server/src/laguna/laguna_backend.cpp:100
↓ 3 callersFunctionlaguna_snapshot_restore
server/src/laguna/laguna_target_graph.cpp:273
↓ 3 callersMethodlm_head_tensor
server/src/laguna/laguna_dflash_target.cpp:519
↓ 3 callersFunctionmake_cpu_moe_expert_compute
server/src/common/moe_expert_compute_cpu.cpp:188
↓ 3 callersFunctionmake_props_config_with_sidecar
server/test/test_server_unit.cpp:3465
↓ 3 callersMethodmask_token_id
server/src/qwen35/qwen35_dflash_target.cpp:719
↓ 3 callersFunctionmeasure
Launch a daemon, run warmup+1 generations, return (decode_tok_s, out_ids).
optimizations/spark/spark/bench.py:54
↓ 3 callersFunctionmkdir_p
server/src/server/disk_prefix_cache.cpp:38
↓ 3 callersFunctionmmq_full_batch_ok
MMQ full-batch mul_mat_id on a reduced hot stack is only stable for large batches. Small batches (spec verify/replay, <=~24 tokens) spread n_used*n_to
server/src/common/moe_hybrid_ffn_eval.cpp:1153
↓ 3 callersFunctionmoe_hybrid_expert_compute_batch_limit
server/src/common/moe_hybrid_ffn_eval.cpp:1180
↓ 3 callersFunctionn_tokens
(prompt: str)
optimizations/pflash/tests/niah_gen.py:54
↓ 3 callersFunctionnormalize_chat_messages
server/src/server/http_server.cpp:728
↓ 3 callersFunctionnsys_report
Run `nsys stats` for the first report-name alias that yields a table. Returns (rows, diag). diag is "" on success, else a one-line reason the
server/scripts/profile.py:203
↓ 3 callersFunctionour_prefill
()
optimizations/megakernel/final_bench.py:66
↓ 3 callersFunctionparse_block_tensor_name
server/src/deepseek4/deepseek4_loader.cpp:149
↓ 3 callersFunctionparse_device_list
(value: str | None, default: list[int])
server/scripts/phase_split_dual_gpu.py:314
↓ 3 callersFunctionparse_float_list
server/test/test_dflash.cpp:226
↓ 3 callersFunctionparse_int_list
server/test/test_dflash.cpp:210
↓ 3 callersFunctionparse_placement_device
server/src/placement/placement_config.h:53
↓ 3 callersMethodpool_chunk
Pool chunk `c` whose rows sit in pool block `block` of each cache tensor in `attn_k` ([head_dim, pool_tokens, n_head_kv], quantized). Reads chunk_toke
server/src/common/kvflash_qk.h:120
↓ 3 callersFunctionprefill
(ids)
optimizations/megakernel/diag_phase2_metrics.py:54
↓ 3 callersFunctionprefill
(ids)
optimizations/megakernel/diag_prefill_kernels.py:49
↓ 3 callersFunctionprobe_health
(base_url: str)
harness/client_test_runner.py:602
↓ 3 callersFunctionprobe_required
(probe: dict[str, Any])
harness/client_test_runner.py:938
↓ 3 callersMethodpropose
server/src/common/dflash_draft_ipc.cpp:205
↓ 3 callersMethodquit
(self, timeout=20)
optimizations/spark/spark/_daemon.py:101
↓ 3 callersFunctionraxDefragDelChars
Remove the specified number of chars from the right of the current key. */
server/src/server/rax.c:2394
↓ 3 callersFunctionraxDefragStackPeek
Return the frame at the top of the defragmentation stack, or NULL if there * are no more nodes to visit. */
server/src/server/rax.c:2353
↓ 3 callersFunctionraxReallocForData
realloc the node to make room for auxiliary data in order * to store an item in that node. On out of memory NULL is returned. */
server/src/server/rax.c:264
↓ 3 callersFunctionraxSeekGreatest
Seek the greatest key in the subtree at the current node. Return 0 on * out of memory, otherwise 1. This is an helper function for different * itera
server/src/server/rax.c:1790
↓ 3 callersFunctionread_bin_f32
server/test/test_vs_oracle.cpp:55
↓ 3 callersMethodread_verify_logits
server/src/qwen35/qwen35_dflash_target.cpp:185
↓ 3 callersFunctionrequire_path
(path: Path, label: str, *, executable: bool = False)
server/scripts/test_prefill_cache.py:37
↓ 3 callersMethodreset
(self)
optimizations/megakernel/model_nvfp4.py:827
↓ 3 callersFunctionreset_recurrent_state
server/src/qwen35/qwen35_target_graph.cpp:324
↓ 3 callersMethodreset_request_graphs
server/src/qwen35moe/qwen35moe_pipelined_decode.cpp:188
↓ 3 callersFunctionround1
Round `x` to 1 decimal place. JSON serialization of doubles can emit 17 significant digits which is noisy in client logs and bench output; caller-side
server/src/server/sse_emitter.cpp:66
↓ 3 callersFunctionrun_child
(args, section)
optimizations/megakernel/bench_pp_tg_nvfp4.py:349
↓ 3 callersFunctionrun_client_probe
( base_url: str, spec: ClientSpec, *, work_dir: Path, include_long: bool, package_chec
harness/client_test_runner.py:944
↓ 3 callersFunctionrun_dflash_spec_decode
server/src/common/dflash_spec_decode.cpp:25
↓ 3 callersFunctionrun_prefill
(decoder, ids_t, prompt_len, buffers, prefill_op, use_mega=False)
optimizations/megakernel/final_bench_nvfp4.py:94
↓ 3 callersFunctionrun_qwen35_mixed_layer_split_forward
server/src/qwen35/layer_split_forward.cpp:550
↓ 3 callersFunctionrun_sweep
Run prefill benchmark at various prompt lengths.
server/scripts/bench_moe_prefill_streaming.py:76
↓ 3 callersFunctionrun_target_shard_ipc_daemon_loop
server/src/common/target_shard_ipc_daemon.cpp:44
↓ 3 callersMethodsave_json
server/src/common/moe_hybrid_placement.cpp:36
↓ 3 callersFunctionselect_activation_precision_policy
server/src/common/backend_precision.cpp:266
↓ 3 callersMethodsend_feature_slice
server/src/common/dflash_draft_ipc.cpp:133
↓ 3 callersMethodsend_response
server/src/server/http_server.cpp:3482
↓ 3 callersFunctionshape_of
(st_name)
server/scripts/convert_dflash_to_gguf.py:114
↓ 3 callersMethodsnapshot_cur_pos
server/src/qwen3/qwen3_backend.cpp:881
↓ 3 callersMethodsnapshot_cur_pos
server/src/common/layer_split_backend.cpp:149
↓ 3 callersMethodsnapshot_kv
server/src/qwen35/qwen35_dflash_target.cpp:495
↓ 3 callersMethodsnapshot_ref
server/src/qwen3/qwen3_backend.cpp:886
↓ 3 callersMethodsnapshot_save
server/test/test_server_unit.cpp:2345
↓ 3 callersMethodsnapshot_used
server/test/test_server_unit.cpp:2347
↓ 3 callersMethodsnapshot_used
server/src/common/layer_split_backend.cpp:145
↓ 3 callersFunctionsock_get_flags
Replace fcntl(F_GETFL) / fcntl(F_SETFL, O_NONBLOCK) with ioctlsocket
server/src/server/http_server.cpp:54
↓ 3 callersFunctionstrip_billing_header_lines
Strip any line whose ltrimmed text starts with kBillingHeader from a multi-line string.
server/src/server/prompt_normalize.cpp:18
↓ 3 callersFunctiontarget_capture_index
server/src/common/dflash_capture.cpp:5
↓ 3 callersFunctiontest_one
server/test/spike_thin_copy.cpp:27
↓ 3 callersFunctiontest_sparse_matches_dense
Compare dense FA output vs sparse FA output At alpha=1.0 (select all blocks), sparse should match dense exactly.
server/test/test_flash_attn_sparse.cpp:14
↓ 3 callersMethodtoken_text
server/src/server/tokenizer.cpp:736
↓ 3 callersFunctionupstream_chat
(upstream: str, payload: dict)
harness/clients/llamacpp_compat_proxy.py:199
↓ 3 callersMethodwait_for
(self, needle: str, timeout_s: float)
server/scripts/phase_split_dual_gpu.py:100
↓ 3 callersMethodwait_ready
Block until the ready banner. Kills + raises SystemExit on timeout/death.
optimizations/spark/spark/_daemon.py:58
↓ 3 callersFunctionwrite_binary_file
server/src/common/io_utils.h:56
↓ 3 callersFunctionwrite_int32_file
server/src/common/io_utils.h:48
↓ 2 callersMethod__init__
(self)
scripts/train_predictor.py:347
↓ 2 callersFunction_alpha_or_die
Parse + range-check alpha. The daemon silently ignores values outside (0, 1) (see dflash/src/qwen3_0p6b_graph.cpp), so reject them here loudly.
optimizations/pflash/tests/bench_niah_cpp.py:9
↓ 2 callersFunction_attach_nvfp4_weights
(weights, group_size=NVFP4_GROUP_SIZE, verbose=True)
optimizations/megakernel/model_nvfp4.py:249
↓ 2 callersFunction_attach_prefill_nvfp4_weights
(weights, verbose=True)
optimizations/megakernel/model_nvfp4.py:218
↓ 2 callersMethod_ensure_prefill_buffers
(self, max_tokens: int)
optimizations/megakernel/model_nvfp4.py:595
↓ 2 callersFunction_find_draft_file
(root: Path)
server/scripts/bench_he.py:184
↓ 2 callersFunction_find_draft_model
(root: Path)
server/scripts/bench_llm.py:67
↓ 2 callersFunction_find_draft_model
(root: Path)
server/scripts/bench_agent.py:70
↓ 2 callersFunction_first_divergence
(a: list[int], b: list[int])
server/scripts/profile.py:296
↓ 2 callersFunction_hip_free_mib
Free GPU memory in MiB via hipMemGetInfo. Reliable on AMD unified-memory APUs (Strix Halo, Phoenix) where rocm-smi only reports the small ded
optimizations/pflash/pflash/dflash_client.py:36
↓ 2 callersFunction_normalize_math
Normalize a math answer string for comparison.
harness/math_scoring.py:36
↓ 2 callersMethod_parse_sse
Parse SSE events from a streaming response. stop_on_event: stop after seeing this event type (e.g. 'message_stop'). If None,
server/tests/test_server_comprehensive.py:71
↓ 2 callersFunction_quantize_matrix_nvfp4_tc
(weight, padded_rows=None)
optimizations/megakernel/model_nvfp4.py:163
↓ 2 callersFunction_read_ids
Read a binary file of packed int32 token IDs.
server/scripts/bench_llm.py:167
↓ 2 callersMethod_relay_response
Relay upstream response back to client, handling SSE streaming.
harness/clients/session_inject_proxy.py:52
↓ 2 callersFunction_require_file
(path: str, label: str)
server/scripts/bench_he.py:216
↓ 2 callersFunction_resolve_backend
(backend)
optimizations/megakernel/model_nvfp4.py:93
↓ 2 callersFunction_resolve_prefill_tc
()
optimizations/megakernel/model_nvfp4.py:121
↓ 2 callersFunction_run_checked
(cmd, timeout: int, label: str)
server/scripts/bench_llm.py:104
↓ 2 callersFunction_run_timed
Run a subprocess, return (CompletedProcess, wall_seconds).
server/scripts/bench_agent.py:103
↓ 2 callersFunction_txt
(idx: int)
server/scripts/laguna_pflash_niah.py:151
↓ 2 callersMethod_upstream_conn
(self)
harness/clients/session_inject_proxy.py:34
↓ 2 callersMethodabort_full_snap
server/src/server/prefix_cache.cpp:460
↓ 2 callersMethodactive
server/src/common/backend_ipc.h:102
↓ 2 callersFunctionadd_common_args
(ap: argparse.ArgumentParser)
server/scripts/phase_split_dual_gpu.py:771
↓ 2 callersFunctionadd_step_tel
server/src/deepseek4/deepseek4_backend.cpp:40
↓ 2 callersFunctionalign_up_size
server/src/laguna/laguna_target_loader.cpp:84
↓ 2 callersFunctionalloc_prefill_buffers
(max_tokens)
optimizations/megakernel/final_bench_nvfp4.py:65
← previousnext →601–700 of 2,878, ranked by callers