MCPcopy Create free account

hub / github.com/crabml/crabml / functions

Functions598 in github.com/crabml/crabml

↓ 1 callersMethoddequantize
(&self, buf: &mut [f32])
crabml-core/src/cpu/buf/buf_q3_k.rs:37
↓ 1 callersMethoddequantize
(&self, buf: &mut [f32])
crabml-core/src/cpu/buf/buf_q4_1.rs:19
↓ 1 callersMethoddequantize
(&self, buf: &mut [f32])
crabml-core/src/cpu/buf/buf_q4_k.rs:24
↓ 1 callersMethoddevice
(&self)
crabml-llama2/src/model.rs:118
↓ 1 callersMethoddimensions
(&self)
crabml-core/src/gguf.rs:676
↓ 1 callersMethoddtype
(&self)
crabml-core/src/cpu/buf/api.rs:123
↓ 1 callersMethoddump_debug_tensor
(&self, name: &str)
crabml-wgpu/src/wgpu_device.rs:173
↓ 1 callersFunctiondump_gguf_metadata
(gf: &GGUFFile)
crabml-cli/src/main.rs:207
↓ 1 callersMethoddup
(&self)
crabml-vulkan/src/vulkan_tensor.rs:252
↓ 1 callersMethodencode
encode the string text (input) into an upper-bound preallocated tokens[] array bos != 0 means prepend the BOS token (=1), eos != 0 means append the EO
crabml-core/src/tokenizer/mod.rs:103
↓ 1 callersMethodencode
encode the string text (input) into an upper-bound preallocated tokens[] array bos != 0 means prepend the BOS token (=1), eos != 0 means append the EO
crabml-core/src/tokenizer/tokenizer_llama.rs:62
↓ 1 callersMethodeos_token
(&self)
crabml-core/src/tokenizer/mod.rs:84
↓ 1 callersMethodexp_cache
(&self)
crabml-core/src/cpu/cpu_device.rs:100
↓ 1 callersFunctionf16_buf_from_bytes
(buf: &[u8])
crabml-core/src/cpu/buf/buf_f16.rs:6
↓ 1 callersFunctionf32_buf_from_bytes
(buf: &[u8])
crabml-core/src/cpu/buf/buf_f32.rs:6
↓ 1 callersMethodforward_gemma
The differences between GEMMA and LLAMA are: 1. the way the ROPE is calculated. 2. it uses GELU instead of SiLU. 3. it scales the input embedding with
crabml-llama2/src/llama2.rs:455
↓ 1 callersMethodforward_llama
(&mut self, tokens: &[usize], pos: usize)
crabml-llama2/src/llama2.rs:213
↓ 1 callersMethodforward_phi2
(&mut self, tokens: &[usize], pos: usize)
crabml-llama2/src/llama2.rs:354
↓ 1 callersMethodforward_qwen2
(&mut self, tokens: &[usize], pos: usize)
crabml-llama2/src/llama2.rs:283
↓ 1 callersMethodgelu_cache
(&self)
crabml-core/src/cpu/cpu_device.rs:104
↓ 1 callersFunctiongelu_inplace
(device: CpuTensorDeviceRef<'a>, buf: &mut CpuTensorBuf<'a>)
crabml-core/src/cpu/primitives/gelu.rs:10
↓ 1 callersMethodgelu_inplace
(self)
crabml-vulkan/src/vulkan_tensor.rs:361
↓ 1 callersFunctiongelu_single
(x: f32)
crabml-core/src/cpu/primitives/gelu.rs:19
↓ 1 callersFunctiongemv_dense_2d_2d
( device: &CpuTensorDeviceRef, bufa: &CpuTensorBuf, // (m, k) bufb: &CpuTensorBuf, // (b,
crabml-core/src/cpu/primitives/matmul_vec.rs:26
↓ 1 callersMethodget_tensor_info
(&self, name: &str)
crabml-core/src/gguf.rs:781
↓ 1 callersMethodinto_inner
(self)
crabml-core/src/cpu/thread_pool.rs:85
↓ 1 callersMethodis_contiguous
(&self)
crabml-core/src/tensor/strider.rs:182
↓ 1 callersMethodis_contiguous_on_axis
if the tensor is contiguous on the given axis, you can safely iterate the axis with a simple `.iter().step_by(strides[axis])`.
crabml-core/src/tensor/strider.rs:188
↓ 1 callersMethodis_valid
(&self)
crabml-core/src/tokenizer/mod.rs:131
↓ 1 callersMethodload_compute_pipeline
( &mut self, pipeline_name: &str, shader_entry_point: shader::EntryPoint, )
crabml-vulkan/src/vulkan_device.rs:545
↓ 1 callersMethodload_config
(&self, gf: &GGUFFile)
crabml-llama2/src/model.rs:553
↓ 1 callersMethodload_modules
(&mut self)
crabml-wgpu/src/wgpu_device.rs:74
↓ 1 callersMethodload_shaders
(&mut self)
crabml-vulkan/src/vulkan_device.rs:107
↓ 1 callersMethodload_tokenizer
(&self, gf: &GGUFFile)
crabml-llama2/src/model.rs:494
↓ 1 callersMethodload_weights
( &self, gf: &'a GGUFFile<'a>, n_layers: usize, device: CpuTensorDeviceRef<'a>
crabml-llama2/src/model.rs:200
↓ 1 callersMethodmake_device_buffer
(&self, bytes_size: usize)
crabml-vulkan/src/vulkan_device.rs:264
↓ 1 callersMethodmake_device_buffer_from_bytes
create a buffer and copy the data from CPU to this buffer
crabml-vulkan/src/vulkan_device.rs:289
↓ 1 callersFunctionmake_q3_quants
(n: usize, nmax: i32, data: &[f32], l: &mut [i8], do_rmse: bool)
crabml-core/src/cpu/buf/util.rs:218
↓ 1 callersFunctionmake_qx_quants
(n: usize, nmax: i32, data: &[f32], ls: &mut [i8], rmse_type: i32)
crabml-core/src/cpu/buf/util.rs:29
↓ 1 callersFunctionmatmul_vec
only dense GEMV is supported (m, k) @ k -> (m, ) (m, k) @ (b, k) -> (b, m)
crabml-core/src/cpu/primitives/matmul_vec.rs:9
↓ 1 callersMethodmatmul_vec
(&self, rhs: &Self)
crabml-vulkan/src/vulkan_tensor.rs:429
↓ 1 callersMethodmatmul_vec
gemv (m, k) @ (k, ) => (m, ) (m, k) @ (b, k) => (b, m, )
crabml-core/src/cpu/cpu_tensor.rs:371
↓ 1 callersMethodname
(&self)
crabml-core/src/gguf.rs:672
↓ 1 callersMethodpipeline_for
(&self, key: &'static str)
crabml-wgpu/src/wgpu_device.rs:114
↓ 1 callersMethodquantize
(&self, dtype: GGMLType)
crabml-core/src/cpu/buf/api.rs:195
↓ 1 callersFunctionquantize_f32_q2_k
(data: &[f32])
crabml-core/src/cpu/buf/buf_q2_k.rs:146
↓ 1 callersFunctionquantize_f32_q3_k
(data: &[f32])
crabml-core/src/cpu/buf/buf_q3_k.rs:159
↓ 1 callersFunctionquantize_f32_q4_0
(data: &[f32])
crabml-core/src/cpu/buf/buf_q4_0.rs:90
↓ 1 callersFunctionquantize_f32_q4_1
(data: &[f32])
crabml-core/src/cpu/buf/buf_q4_1.rs:94
↓ 1 callersFunctionquantize_f32_q4_k
(data: &[f32])
crabml-core/src/cpu/buf/buf_q4_k.rs:111
↓ 1 callersFunctionquantize_f32_q5_0
(data: &[f32])
crabml-core/src/cpu/buf/buf_q5_0.rs:100
↓ 1 callersFunctionquantize_f32_q5_1
(data: &[f32])
crabml-core/src/cpu/buf/buf_q5_1.rs:101
↓ 1 callersFunctionquantize_f32_q5_k
(data: &[f32])
crabml-core/src/cpu/buf/buf_q5_k.rs:123
↓ 1 callersFunctionquantize_f32_q6_k
(data: &[f32])
crabml-core/src/cpu/buf/buf_q6_k.rs:111
↓ 1 callersFunctionquantize_f32_q8_0
(data: &[f32])
crabml-core/src/cpu/buf/buf_q8_0.rs:87
↓ 1 callersFunctionquantize_f32_q8_1
(data: &[f32])
crabml-core/src/cpu/buf/buf_q8_1.rs:90
↓ 1 callersFunctionquantize_f32_q8_k
(data: &[f32])
crabml-core/src/cpu/buf/buf_q8_k.rs:84
↓ 1 callersMethodread_array
(&mut self)
crabml-core/src/gguf.rs:341
↓ 1 callersMethodread_bytes
(&self)
crabml-core/src/gguf.rs:279
↓ 1 callersMethodread_len_array
compat v1 & v2 on the type change of the field dimensions[n]. for more information: https://github.com/philpax/ggml/commit/b021b2577d4294800ece200c9f2
crabml-core/src/gguf.rs:410
↓ 1 callersMethodread_value
(&mut self)
crabml-core/src/gguf.rs:320
↓ 1 callersMethodrecord_debug_tensor
(&self, name: String, tensor: &impl Tensor)
crabml-vulkan/src/vulkan_device.rs:188
↓ 1 callersMethodrecord_debug_tensor
(&self, name: String, tensor: &impl Tensor)
crabml-wgpu/src/wgpu_device.rs:167
↓ 1 callersMethodresize
(self, axis: usize, n: usize)
crabml-core/src/cpu/cpu_tensor.rs:167
↓ 1 callersFunctionrms_norm_inplace
( buf: &mut CpuTensorBuf<'_>, strider: &TensorStrider, eps: f32, )
crabml-core/src/cpu/primitives/rms_norm.rs:9
↓ 1 callersMethodrms_norm_inplace
(self, eps: f32)
crabml-vulkan/src/vulkan_tensor.rs:300
↓ 1 callersFunctionrms_norm_inplace_vec_f32
(x: &mut [f32], eps: f32)
crabml-core/src/cpu/primitives/rms_norm.rs:32
↓ 1 callersFunctionrope_inplace
only support f32 yet TODO: support f16
crabml-core/src/cpu/primitives/rope.rs:10
↓ 1 callersMethodrope_inplace
( self, mode: crabml::tensor::RopeMode, pos: usize, rope_dims: usize, )
crabml-vulkan/src/vulkan_tensor.rs:267
↓ 1 callersMethodrope_inplace
(mut self, mode: RopeMode, pos: usize, rope_dims: usize)
crabml-core/src/cpu/cpu_tensor.rs:431
↓ 1 callersFunctionrope_llama
(buf: &mut [f32], pos: usize, head_dim: usize, rope_dim: usize)
crabml-core/src/cpu/primitives/rope.rs:47
↓ 1 callersFunctionrope_neox
(buf: &mut [f32], pos: usize, head_dim: usize, rope_dim: usize)
crabml-core/src/cpu/primitives/rope.rs:65
↓ 1 callersFunctionrun_chat
(runner: &mut Llama2Runner<T>, args: &CommandArgs)
crabml-cli/src/main.rs:91
↓ 1 callersFunctionrun_generate
(runner: &mut Llama2Runner<U>, args: &CommandArgs)
crabml-cli/src/main.rs:136
↓ 1 callersMethodsampler
(&self)
crabml-llama2/src/model.rs:130
↓ 1 callersMethodscale_inplace
(self, rhs: f32)
crabml-vulkan/src/vulkan_tensor.rs:411
↓ 1 callersMethodscoped
(&self, f: F)
crabml-core/src/cpu/thread_pool.rs:38
↓ 1 callersFunctionsilu_inplace
(device: CpuTensorDeviceRef<'a>, buf: &mut CpuTensorBuf<'a>)
crabml-core/src/cpu/primitives/silu.rs:6
↓ 1 callersMethodsilu_inplace
(self)
crabml-vulkan/src/vulkan_tensor.rs:351
↓ 1 callersMethodsilu_inplace
(mut self)
crabml-core/src/cpu/cpu_tensor.rs:412
↓ 1 callersFunctionsimple_rmsnorm
(x: &mut [f32])
crabml-vulkan/src/vulkan_tensor.rs:619
↓ 1 callersFunctionsimple_rmsnorm
it seems that webgpu have a different rounding method on dividing f32: https://stackoverflow.com/questions/73674463/does-rust-f64-f32-round-correctly
crabml-wgpu/src/wgpu_tensor.rs:855
↓ 1 callersFunctionsoftmax
(a: &mut [f32], exp_cache: &[f16])
crabml-llama2/src/sampler.rs:119
↓ 1 callersFunctionsoftmax_inplace
TODO: support f16
crabml-core/src/cpu/primitives/softmax.rs:11
↓ 1 callersMethodsoftmax_inplace
(self, axis: usize)
crabml-vulkan/src/vulkan_tensor.rs:326
↓ 1 callersMethodsoftmax_inplace
(mut self, axis: usize)
crabml-core/src/cpu/cpu_tensor.rs:424
↓ 1 callersMethodspawn
(&mut self, f: F)
crabml-core/src/cpu/thread_pool.rs:79
↓ 1 callersMethodstep
(&mut self, bytes: &[u8])
crabml-core/src/tokenizer/mod.rs:135
↓ 1 callersMethodstop_mark
(&self)
crabml-llama2/src/chat.rs:220
↓ 1 callersFunctionsum_i16_pairs_float
(xh: __m128i, xl: __m128i)
crabml-core/src/cpu/archutil/x86_64.rs:27
↓ 1 callersMethodthread_num
(&self)
crabml-core/src/cpu/cpu_device.rs:88
↓ 1 callersMethodthread_pool
(&self)
crabml-core/src/cpu/cpu_device.rs:92
↓ 1 callersMethodtoken
(&self, token_id: TokenID)
crabml-core/src/tokenizer/mod.rs:88
↓ 1 callersMethodtokenizer
(&self)
crabml-llama2/src/model.rs:126
↓ 1 callersMethodtranspose
(self, dims: &[usize])
crabml-vulkan/src/vulkan_tensor.rs:143
↓ 1 callersMethodtranspose
(self, dims: &[usize])
crabml-wgpu/src/wgpu_tensor.rs:176
↓ 1 callersFunctionvcvt_f32_f16
(i: float32x4_t)
crabml-core/src/cpu/archutil/aarch64.rs:34
↓ 1 callersFunctionvec_convert_f16_f32
(dst: &mut [f16], src: &[f32])
crabml-core/src/cpu/buf/buf_f16.rs:165
↓ 1 callersFunctionvec_convert_f16_f32_neon
(dst: &mut [f16], src: &[f32])
crabml-core/src/cpu/buf/buf_f16.rs:176
↓ 1 callersMethodvec_dot
(&self, a_offset: usize, b: &Self, b_offset: usize, len: usize)
crabml-core/src/cpu/buf/api.rs:230
← previousnext →201–300 of 598, ranked by callers