Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/RightNow-AI/autokernel
/ types & classes
Types & classes
28 in github.com/RightNow-AI/autokernel
⨍
Functions
293
◇
Types & classes
28
↓ 7 callers
Class
_Timeout
Context-manager wall-clock timeout. Works on both Unix (SIGALRM) and Windows (thread-based fallback).
bench.py:43
↓ 4 callers
Class
RMSNorm
models/llama_7b.py:22
↓ 3 callers
Class
GPUSpec
profile.py:77
↓ 3 callers
Class
KernelBenchProblem
A single KernelBench problem.
kernelbench/bridge.py:48
↓ 2 callers
Class
GPUSpec
bench.py:90
↓ 2 callers
Class
KernelReplacement
Describes a single kernel replacement: what to replace and with what.
verify.py:63
↓ 2 callers
Class
OptimizedModelContext
Context manager that patches a model's submodules to use optimized Triton kernels. Usage: with OptimizedModelContext(model, replacem
verify.py:510
↓ 2 callers
Class
TransformerBlock
models/llama_7b.py:101
↓ 1 callers
Class
Attention
models/llama_7b.py:51
↓ 1 callers
Class
BenchTimeoutError
bench.py:39
↓ 1 callers
Class
BertLayer
models/bert_base.py:55
↓ 1 callers
Class
BertMLP
models/bert_base.py:43
↓ 1 callers
Class
BertSelfAttention
models/bert_base.py:16
↓ 1 callers
Class
Block
models/gpt2.py:73
↓ 1 callers
Class
CausalSelfAttention
models/gpt2.py:18
↓ 1 callers
Class
FeedForward
SwiGLU MLP (LLaMA-style).
models/llama_7b.py:88
↓ 1 callers
Class
KernelRecord
Aggregated stats for one kernel (name + shape combo).
profile.py:505
↓ 1 callers
Class
MLP
models/gpt2.py:57
↓ 1 callers
Class
VerificationResult
Full verification result.
verify.py:73
↓ 1 callers
Class
_LayerNormWrapper
Wraps nn.LayerNorm to use an optimized kernel_fn.
verify.py:441
↓ 1 callers
Class
_LinearWrapper
Wraps nn.Linear to use an optimized matmul kernel_fn.
verify.py:408
↓ 1 callers
Class
_RMSNormWrapper
Wraps RMSNorm-like modules to use an optimized kernel_fn.
verify.py:478
↓ 1 callers
Class
_Timeout
Context manager that raises TimeoutError after `seconds`.
kernelbench/bench_kb.py:68
Class
BertModel
BERT-base: hidden_size=768, num_layers=12, num_heads=12, intermediate=3072 (110M params).
models/bert_base.py:69
Class
GPT2
GPT-2 124M (small) by default. Configurable via constructor args. Sizes: - GPT-2 Small: n_layer=12, n_head=12, n_embd=768 (124M par
models/gpt2.py:87
Class
LlamaModel
Compact LLaMA (160M params) -- fits on any GPU, good for testing AutoKernel. Config: dim=768, n_layers=12, n_heads=12, n_kv_heads=4, hidden_
models/llama_7b.py:115
Class
LlamaModel7B
LLaMA-7B scale -- requires ~14GB VRAM in fp16. Config: dim=4096, n_layers=32, n_heads=32, n_kv_heads=8, hidden_dim=11008
models/llama_7b.py:164
Class
MyModel
Example custom model -- a simple CNN + MLP. Replace this with your own architecture.
models/custom.py:13