Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/GeeeekExplorer/nano-vllm
/ functions
Functions
108 in github.com/GeeeekExplorer/nano-vllm
⨍
Functions
108
◇
Types & classes
29
↓ 5 callers
Method
__init__
( self, input_size: int, output_size: int, bias: bool = False, tp_dim:
nanovllm/layers/linear.py:14
↓ 4 callers
Method
__init__
( self, hidden_size: int, intermediate_size: int, hidden_act: str, )
nanovllm/models/qwen3.py:93
↓ 4 callers
Function
divide
(numerator, denominator)
nanovllm/layers/linear.py:7
↓ 4 callers
Method
update
(self, hash: int, token_ids: list[int])
nanovllm/engine/block_manager.py:16
↓ 3 callers
Method
add
(self, seq: Sequence)
nanovllm/engine/scheduler.py:22
↓ 3 callers
Method
block
(self, i)
nanovllm/engine/sequence.py:63
↓ 3 callers
Method
call
(self, method_name, *args)
nanovllm/engine/model_runner.py:85
↓ 3 callers
Method
compute_hash
(cls, token_ids: list[int], prefix: int = -1)
nanovllm/engine/block_manager.py:36
↓ 3 callers
Method
generate
( self, prompts: list[str] | list[list[int]], sampling_params: SamplingParams | list[S
nanovllm/engine/llm_engine.py:60
↓ 3 callers
Function
get_context
()
nanovllm/utils/context.py:18
↓ 3 callers
Function
set_context
(is_prefill, cu_seqlens_q=None, cu_seqlens_k=None, max_seqlen_q=0, max_seqlen_k=0, slot_mapping=None, context_
nanovllm/utils/context.py:21
↓ 2 callers
Method
_allocate_block
(self)
nanovllm/engine/block_manager.py:43
↓ 2 callers
Function
apply_rotary_emb
( x: torch.Tensor, cos: torch.Tensor, sin: torch.Tensor, )
nanovllm/layers/rotary_embedding.py:6
↓ 2 callers
Method
compute_logits
( self, hidden_states: torch.Tensor, )
nanovllm/models/qwen3.py:212
↓ 2 callers
Method
deallocate
(self, seq: Sequence)
nanovllm/engine/block_manager.py:94
↓ 2 callers
Method
preempt
(self, seq: Sequence)
nanovllm/engine/scheduler.py:75
↓ 2 callers
Method
prepare_block_tables
(self, seqs: list[Sequence])
nanovllm/engine/model_runner.py:123
↓ 2 callers
Function
reset_context
()
nanovllm/utils/context.py:25
↓ 1 callers
Method
__init__
( self, num_embeddings: int, embedding_dim: int, bias: bool = False, )
nanovllm/layers/embed_head.py:47
↓ 1 callers
Method
_deallocate_block
(self, block_id: int)
nanovllm/engine/block_manager.py:53
↓ 1 callers
Method
add_request
(self, prompt: str | list[int], sampling_params: SamplingParams)
nanovllm/engine/llm_engine.py:43
↓ 1 callers
Method
add_rms_forward
( self, x: torch.Tensor, residual: torch.Tensor, )
nanovllm/layers/layernorm.py:29
↓ 1 callers
Method
allocate
(self, seq: Sequence, num_cached_blocks: int)
nanovllm/engine/block_manager.py:75
↓ 1 callers
Method
allocate_kv_cache
(self)
nanovllm/engine/model_runner.py:103
↓ 1 callers
Method
append_token
(self, token_id: int)
nanovllm/engine/sequence.py:67
↓ 1 callers
Method
can_allocate
(self, seq: Sequence)
nanovllm/engine/block_manager.py:58
↓ 1 callers
Method
can_append
(self, seq: Sequence)
nanovllm/engine/block_manager.py:103
↓ 1 callers
Method
capture_cudagraph
(self)
nanovllm/engine/model_runner.py:223
↓ 1 callers
Function
get_rope
( head_size: int, rotary_dim: int, max_position: int, base: float, )
nanovllm/layers/rotary_embedding.py:52
↓ 1 callers
Method
hash_blocks
(self, seq: Sequence)
nanovllm/engine/block_manager.py:110
↓ 1 callers
Method
is_finished
(self)
nanovllm/engine/llm_engine.py:57
↓ 1 callers
Function
load_model
(model: nn.Module, path: str)
nanovllm/utils/loader.py:12
↓ 1 callers
Method
loop
(self)
nanovllm/engine/model_runner.py:61
↓ 1 callers
Function
main
()
example.py:6
↓ 1 callers
Function
main
()
bench.py:8
↓ 1 callers
Method
may_append
(self, seq: Sequence)
nanovllm/engine/block_manager.py:106
↓ 1 callers
Method
postprocess
(self, seqs: list[Sequence], token_ids: list[int], is_prefill: bool)
nanovllm/engine/scheduler.py:81
↓ 1 callers
Method
prepare_decode
(self, seqs: list[Sequence])
nanovllm/engine/model_runner.py:172
↓ 1 callers
Method
prepare_prefill
(self, seqs: list[Sequence])
nanovllm/engine/model_runner.py:129
↓ 1 callers
Method
prepare_sample
(self, seqs: list[Sequence])
nanovllm/engine/model_runner.py:190
↓ 1 callers
Method
read_shm
(self)
nanovllm/engine/model_runner.py:68
↓ 1 callers
Method
reset
(self)
nanovllm/engine/block_manager.py:20
↓ 1 callers
Method
rms_forward
( self, x: torch.Tensor, )
nanovllm/layers/layernorm.py:17
↓ 1 callers
Method
run
(self, seqs: list[Sequence], is_prefill: bool)
nanovllm/engine/model_runner.py:214
↓ 1 callers
Method
run_model
(self, input_ids: torch.Tensor, positions: torch.Tensor, is_prefill: bool)
nanovllm/engine/model_runner.py:196
↓ 1 callers
Method
schedule
(self)
nanovllm/engine/scheduler.py:25
↓ 1 callers
Method
step
(self)
nanovllm/engine/llm_engine.py:49
↓ 1 callers
Function
store_kvcache
(key: torch.Tensor, value: torch.Tensor, k_cache: torch.Tensor, v_cache: torch.Tensor, slot_mapping: torch.Ten
nanovllm/layers/attention.py:33
↓ 1 callers
Method
warmup_model
(self)
nanovllm/engine/model_runner.py:91
↓ 1 callers
Method
write_shm
(self, method_name, *args)
nanovllm/engine/model_runner.py:76
Method
__getitem__
(self, key)
nanovllm/engine/sequence.py:36
Method
__getstate__
(self)
nanovllm/engine/sequence.py:72
Method
__init__
(self, config: Config)
nanovllm/engine/scheduler.py:10
Method
__init__
(self, block_id)
nanovllm/engine/block_manager.py:10
Method
__init__
(self, num_blocks: int, block_size: int)
nanovllm/engine/block_manager.py:28
Method
__init__
(self, config: Config, rank: int, event: Event | list[Event])
nanovllm/engine/model_runner.py:17
Method
__init__
(self, token_ids: list[int], sampling_params = SamplingParams())
nanovllm/engine/sequence.py:18
Method
__init__
(self, model, **kwargs)
nanovllm/engine/llm_engine.py:17
Method
__init__
( self, hidden_size: int, eps: float = 1e-6, )
nanovllm/layers/layernorm.py:7
Method
__init__
( self, num_embeddings: int, embedding_dim: int, )
nanovllm/layers/embed_head.py:11
Method
__init__
( self, input_size: int, output_size: int, bias: bool = False, )
nanovllm/layers/linear.py:39
Method
__init__
( self, input_size: int, output_size: int, bias: bool = False, )
nanovllm/layers/linear.py:56
Method
__init__
( self, input_size: int, output_sizes: list[int], bias: bool = False, )
nanovllm/layers/linear.py:78
Method
__init__
( self, hidden_size: int, head_size: int, total_num_heads: int, total_
nanovllm/layers/linear.py:98
Method
__init__
( self, input_size: int, output_size: int, bias: bool = False, )
nanovllm/layers/linear.py:133
Method
__init__
( self, head_size: int, rotary_dim: int, max_position_embeddings: int,
nanovllm/layers/rotary_embedding.py:19
Method
__init__
( self, num_heads, head_dim, scale, num_kv_heads, )
nanovllm/layers/attention.py:45
Method
__init__
( self, hidden_size: int, num_heads: int, num_kv_heads: int, max_posit
nanovllm/models/qwen3.py:16
Method
__init__
( self, config: Qwen3Config, )
nanovllm/models/qwen3.py:122
Method
__init__
( self, config: Qwen3Config, )
nanovllm/models/qwen3.py:164
Method
__init__
( self, config: Qwen3Config )
nanovllm/models/qwen3.py:195
Method
__len__
(self)
nanovllm/engine/sequence.py:33
Method
__post_init__
(self)
nanovllm/config.py:20
Method
__post_init__
(self)
nanovllm/sampling_params.py:10
Method
__setstate__
(self, state)
nanovllm/engine/sequence.py:76
Method
completion_token_ids
(self)
nanovllm/engine/sequence.py:52
Function
default_weight_loader
(param: nn.Parameter, loaded_weight: torch.Tensor)
nanovllm/utils/loader.py:8
Method
exit
(self)
nanovllm/engine/model_runner.py:50
Method
exit
(self)
nanovllm/engine/llm_engine.py:37
Method
forward
( self, x: torch.Tensor, residual: torch.Tensor | None = None, )
nanovllm/layers/layernorm.py:42
Method
forward
(self, x: torch.Tensor)
nanovllm/layers/embed_head.py:34
Method
forward
(self, x: torch.Tensor)
nanovllm/layers/embed_head.py:56
Method
forward
(self, x: torch.Tensor)
nanovllm/layers/linear.py:33
Method
forward
(self, x: torch.Tensor)
nanovllm/layers/linear.py:50
Method
forward
(self, x: torch.Tensor)
nanovllm/layers/linear.py:72
Method
forward
(self, x: torch.Tensor)
nanovllm/layers/linear.py:152
Method
forward
( self, positions: torch.Tensor, query: torch.Tensor, key: torch.Tensor, )
nanovllm/layers/rotary_embedding.py:38
Method
forward
(self, q: torch.Tensor, k: torch.Tensor, v: torch.Tensor)
nanovllm/layers/attention.py:59
Method
forward
(self, logits: torch.Tensor, temperatures: torch.Tensor)
nanovllm/layers/sampler.py:8
Method
forward
(self, x: torch.Tensor)
nanovllm/layers/activation.py:9
Method
forward
( self, positions: torch.Tensor, hidden_states: torch.Tensor, )
nanovllm/models/qwen3.py:72
Method
forward
(self, x)
nanovllm/models/qwen3.py:113
Method
forward
( self, positions: torch.Tensor, hidden_states: torch.Tensor, residual: torch.
nanovllm/models/qwen3.py:146
Method
forward
( self, input_ids: torch.Tensor, positions: torch.Tensor, )
nanovllm/models/qwen3.py:173
Method
forward
( self, input_ids: torch.Tensor, positions: torch.Tensor, )
nanovllm/models/qwen3.py:205
Method
is_finished
(self)
nanovllm/engine/scheduler.py:19
Method
is_finished
(self)
nanovllm/engine/sequence.py:40
Method
last_block_num_tokens
(self)
nanovllm/engine/sequence.py:60
Method
num_blocks
(self)
nanovllm/engine/sequence.py:56
Method
num_completion_tokens
(self)
nanovllm/engine/sequence.py:44
next →
1–100 of 108, ranked by callers