↓ 1 callersFunctionbenchmark_decode(decoder, prompt_ids, gen_tokens, tokenizer, buffers, prefill_op)
optimizations/megakernel/bench_pp_tg_nvfp4.py:151
↓ 1 callersFunctionbenchmark_prefill(decoder, ids_t, prompt_len, buffers, prefill_op, warmup_runs, measure_runs)
optimizations/megakernel/bench_pp_tg_nvfp4.py:138
↓ 1 callersMethodcompress(self, drafter_ids: list[int], keep_x1000: int,
lookahead: int, chunk: int, pool: int)
server/scripts/laguna_pflash_niah.py:234
↓ 1 callersMethodcompress(self, counted_ids: Path, *, keep_ratio: float, lookahead: int,
chunk_size: int, pool_kernel:
server/scripts/phase_split_dual_gpu.py:154