Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/bitsandbytes-foundation/bitsandbytes
/ functions
Functions
720 in github.com/bitsandbytes-foundation/bitsandbytes
⨍
Functions
720
◇
Types & classes
117
↳
Endpoints
78
↓ 1 callers
Function
fmt_mb
(nbytes)
examples/xpu/benchmark_paged_memory.py:142
↓ 1 callers
Function
format_alpaca
(example)
examples/xpu/paged_xpu_training.py:59
↓ 1 callers
Function
format_alpaca
(example)
examples/cpu/cpu_training.py:63
↓ 1 callers
Function
format_detail
Full detail view of an issue including body and comments.
agents/query_issues.py:201
↓ 1 callers
Function
format_list_line
Compact one-line summary for list view, with date and key metadata.
agents/query_issues.py:182
↓ 1 callers
Function
format_with_label
(label: str, value: Any)
tests/helpers.py:71
↓ 1 callers
Method
forward
Forward pass to dequantize the parameter. Args: quantized_param (`torch.Tensor`): The quantized parameter tensor (from .
bitsandbytes/nn/parametrize.py:29
↓ 1 callers
Method
from_prequantized
( cls, data: torch.Tensor, quantized_stats: dict[str, Any], requires_grad: boo
bitsandbytes/nn/modules.py:356
↓ 1 callers
Function
gemm_4bit_inference_naive_bf16
csrc/pythonInterface.cpp:46
↓ 1 callers
Function
gemm_4bit_inference_naive_fp16
csrc/pythonInterface.cpp:39
↓ 1 callers
Function
gemm_4bit_inference_naive_fp32
csrc/pythonInterface.cpp:53
↓ 1 callers
Function
gemv_4bit_inference_bf16
csrc/pythonInterface.cpp:312
↓ 1 callers
Function
gemv_4bit_inference_fp16
csrc/pythonInterface.cpp:305
↓ 1 callers
Function
gemv_4bit_inference_fp32
csrc/pythonInterface.cpp:321
↓ 1 callers
Function
get_4bit_config
()
tests/test_generation.py:12
↓ 1 callers
Function
get_args
()
examples/xpu/benchmark_paged_memory.py:22
↓ 1 callers
Function
get_args
()
examples/xpu/paged_xpu_training.py:21
↓ 1 callers
Function
get_args
()
examples/cpu/cpu_training.py:25
↓ 1 callers
Function
get_available_cuda_binary_versions
Get formatted CUDA/ROCm versions from existing library files.
bitsandbytes/cextension.py:152
↓ 1 callers
Function
get_compute_capabilities
()
bitsandbytes/cuda_specs.py:23
↓ 1 callers
Function
get_cuda_version_string
Get CUDA/HIP version as a string.
bitsandbytes/cuda_specs.py:46
↓ 1 callers
Function
get_gaudi_sw_version
Returns the installed version of Gaudi SW.
bitsandbytes/backends/utils.py:78
↓ 1 callers
Function
get_global_lut
csrc/cpu_ops.cpp:563
↓ 1 callers
Function
get_inputs
(tokenizer)
benchmarking/xpu/inference_benchmark.py:34
↓ 1 callers
Method
get_lut
csrc/cpu_ops.cpp:539
↓ 1 callers
Function
get_max_threads
csrc/cpu_ops.h:62
↓ 1 callers
Function
get_model_and_tokenizer
(config)
tests/test_generation.py:24
↓ 1 callers
Function
get_native_library
Load CUDA library XOR CPU, as the latter contains a subset of symbols of the former.
bitsandbytes/cextension.py:348
↓ 1 callers
Method
get_outliers
(self, weight)
bitsandbytes/utils.py:69
↓ 1 callers
Function
get_package_version
(name: str)
bitsandbytes/diagnostics/main.py:42
↓ 1 callers
Function
get_potentially_lib_path_containing_env_vars
()
bitsandbytes/diagnostics/cuda.py:85
↓ 1 callers
Function
get_rocm_gpu_arch
Get ROCm GPU architecture.
bitsandbytes/cuda_specs.py:82
↓ 1 callers
Function
get_streamer
(tokenizer)
benchmarking/xpu/inference_benchmark.py:45
↓ 1 callers
Function
get_test_dims
(min: int, max: int, *, n: int)
tests/helpers.py:67
↓ 1 callers
Function
get_torch_dtype
(name)
examples/xpu/benchmark_paged_memory.py:37
↓ 1 callers
Function
get_xpu_bnb_library_path
Get the path to the XPU native library matching the oneAPI toolchain. Prefers the versioned library (e.g. libbitsandbytes_xpu2026) matching the f
bitsandbytes/cextension.py:334
↓ 1 callers
Function
gh_graphql
Execute a GraphQL query via the gh CLI, passing the full payload as JSON on stdin.
agents/fetch_issues.py:69
↓ 1 callers
Function
igemmlt_32
csrc/pythonInterface.cpp:223
↓ 1 callers
Function
igemmlt_8
csrc/pythonInterface.cpp:230
↓ 1 callers
Function
igemmlt_8_rowscale
csrc/pythonInterface.cpp:237
↓ 1 callers
Method
init_8bit_state
(self)
bitsandbytes/nn/modules.py:1159
↓ 1 callers
Method
init_state
(self, group, p, gindex, pindex)
bitsandbytes/optim/optimizer.py:368
↓ 1 callers
Method
initialize
(self)
bitsandbytes/optim/optimizer.py:36
↓ 1 callers
Method
initialize
(self)
bitsandbytes/autograd/_functions.py:31
↓ 1 callers
Function
is_relevant_candidate_env_var
(env_var: str, value: str)
bitsandbytes/diagnostics/cuda.py:72
↓ 1 callers
Function
linear8bit
(request)
tests/test_linear8bitlt.py:176
↓ 1 callers
Function
load_data
(path: str)
agents/query_issues.py:162
↓ 1 callers
Function
main
()
bitsandbytes/diagnostics/main.py:70
↓ 1 callers
Function
main
()
scripts/stale.py:30
↓ 1 callers
Function
main
()
tests/fsdp_state_dict_save.py:63
↓ 1 callers
Function
main
()
examples/xpu/benchmark_paged_memory.py:150
↓ 1 callers
Function
main
()
examples/xpu/paged_xpu_training.py:290
↓ 1 callers
Function
main
()
examples/cpu/cpu_training.py:306
↓ 1 callers
Function
main
()
agents/fetch_issues.py:223
↓ 1 callers
Function
main
()
agents/query_issues.py:537
↓ 1 callers
Function
make_batch
Create a random batch of input_ids and labels.
examples/xpu/benchmark_paged_memory.py:67
↓ 1 callers
Function
measure_training
Run a few training steps and return peak GPU memory in bytes.
examples/xpu/benchmark_paged_memory.py:82
↓ 1 callers
Function
neon_dequant_4bit_16values
Vectorized 4-bit dequantization: process 8 packed bytes = 16 output values Each byte contains two 4-bit values: high nibble first, low nibble second
csrc/cpu_ops.cpp:89
↓ 1 callers
Function
neon_fp4_lut
ARM NEON FP4 lookup table
csrc/cpu_ops.cpp:72
↓ 1 callers
Function
neon_nf4_lut
ARM NEON NF4 lookup table (16 float values indexed by 4-bit code)
csrc/cpu_ops.cpp:44
↓ 1 callers
Function
neon_norm_to_lut_index_x4
NEON-optimized norm_to_lut_index for 4 float values at a time Maps [-1, 1] → [0, 65535]
csrc/cpu_ops.cpp:221
↓ 1 callers
Function
norm_to_lut_index
Convert a normalized value in [-1, 1] to LUT index [0, 65535]
csrc/cpu_ops.cpp:569
↓ 1 callers
Function
one_step
(max_unorm)
tests/test_optim.py:703
↓ 1 callers
Function
optimizer_update_8bit_blockwise_impl
( optimizer_name: str, g: torch.Tensor, p: torch.Tensor, state1: torch.Tensor, state2: Opt
bitsandbytes/backends/triton/kernels_optim.py:1099
↓ 1 callers
Function
pack_dict_to_tensor
Pack a dictionary into a torch tensor for storing quant_state items in state_dict. Parameters: - source_dict: The dictionary to be packe
bitsandbytes/utils.py:166
↓ 1 callers
Function
parallel_2d
csrc/cpu_ops.h:78
↓ 1 callers
Function
parse_args
()
benchmarking/inference_benchmark.py:83
↓ 1 callers
Function
parse_arguments
()
benchmarking/xpu/inference_benchmark.py:82
↓ 1 callers
Function
parse_cuda_version
Convert a raw version code string (e.g. '118', '713') to a dotted version (e.g. '11.8', '7.13').
bitsandbytes/cextension.py:159
↓ 1 callers
Method
prefetch_state
(self, p)
bitsandbytes/optim/optimizer.py:392
↓ 1 callers
Function
print_diagnostics
(cuda_specs: CUDASpecs)
bitsandbytes/diagnostics/cuda.py:165
↓ 1 callers
Function
print_header
(txt: str, width: int = HEADER_WIDTH, filler: str = "=")
bitsandbytes/diagnostics/utils.py:6
↓ 1 callers
Method
print_report
(self)
benchmarking/xpu/inference_benchmark.py:68
↓ 1 callers
Function
quantizeBlockwise_bf16
csrc/pythonInterface.cpp:139
↓ 1 callers
Function
quantizeBlockwise_bf16_fp4
csrc/pythonInterface.cpp:145
↓ 1 callers
Function
quantizeBlockwise_bf16_nf4
csrc/pythonInterface.cpp:151
↓ 1 callers
Function
quantizeBlockwise_fp16
csrc/pythonInterface.cpp:127
↓ 1 callers
Function
quantizeBlockwise_fp16_fp4
csrc/pythonInterface.cpp:131
↓ 1 callers
Function
quantizeBlockwise_fp16_nf4
csrc/pythonInterface.cpp:135
↓ 1 callers
Function
quantizeBlockwise_fp32
csrc/pythonInterface.cpp:157
↓ 1 callers
Function
quantizeBlockwise_fp32_fp4
csrc/pythonInterface.cpp:161
↓ 1 callers
Function
quantizeBlockwise_fp32_nf4
csrc/pythonInterface.cpp:165
↓ 1 callers
Function
quantize_blockwise_triton
(A, code, blocksize, absmax=None, out=None)
bitsandbytes/backends/triton/kernels_8bit_quant.py:107
↓ 1 callers
Function
quantize_cpu
csrc/cpu_ops.cpp:667
↓ 1 callers
Function
quantize_cpu_bf16
csrc/cpu_ops.cpp:671
↓ 1 callers
Function
quantize_cpu_fp16
csrc/cpu_ops.cpp:675
↓ 1 callers
Method
quantize_weight
(self, w, outlier_idx)
bitsandbytes/nn/modules.py:1206
↓ 1 callers
Method
reset_parameters
(self)
bitsandbytes/nn/modules.py:101
↓ 1 callers
Function
run_benchmark
(args, config, batch_size)
benchmarking/inference_benchmark.py:120
↓ 1 callers
Function
run_compare
Compare paged_adamw vs adamw numerically.
examples/xpu/paged_xpu_training.py:250
↓ 1 callers
Function
run_compare
Compare bnb AdamW vs torch AdamW on CPU to verify correctness.
examples/cpu/cpu_training.py:193
↓ 1 callers
Function
run_single
Train with one optimizer and report results.
examples/xpu/paged_xpu_training.py:146
↓ 1 callers
Function
run_single
(args)
examples/cpu/cpu_training.py:152
↓ 1 callers
Function
run_with_trainer
Train using HuggingFace Trainer with a bnb optimizer.
examples/xpu/paged_xpu_training.py:184
↓ 1 callers
Function
run_with_trainer
Train using HuggingFace Trainer with a bnb optimizer on CPU.
examples/cpu/cpu_training.py:239
↓ 1 callers
Function
sanity_check
()
bitsandbytes/diagnostics/main.py:27
↓ 1 callers
Method
set_compute_type
(self, x)
bitsandbytes/nn/modules.py:575
↓ 1 callers
Function
set_fp4_lut
csrc/cpu_ops.cpp:271
↓ 1 callers
Function
set_nf4_lut
csrc/cpu_ops.cpp:263
↓ 1 callers
Function
show_environment
Simple utility to print out environment information.
bitsandbytes/diagnostics/main.py:50
← previous
next →
201–300 of 720, ranked by callers