Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/KarelPeeters/Kyanite
/ functions
Functions
1,306 in github.com/KarelPeeters/Kyanite
⨍
Functions
1,306
◇
Types & classes
523
↓ 3 callers
Function
assert_tensors_match
(expected: &[DTensor], actual: &[DTensor], print_match: bool)
kn-cuda-eval/src/tester.rs:32
↓ 3 callers
Method
call
(&mut self, graph: &Graph, inputs: &[Value])
kn-graph/src/graph.rs:1319
↓ 3 callers
Method
clone_map_inputs
(&self, mut f: impl FnMut(Value) -> Value)
kn-graph/src/graph.rs:253
↓ 3 callers
Method
components_factor_exp
(self)
kn-graph/src/shape.rs:270
↓ 3 callers
Method
copy_from
(&self, other: &DeviceTensor)
kn-cuda-eval/src/device_tensor.rs:102
↓ 3 callers
Function
cublasMigrateComputeType
kn-cuda-sys/doc_headers/cuda_include/cublas_api.h:5540
↓ 3 callers
Function
cudaOccupancyMaxActiveBlocksPerMultiprocessorWithFlags
kn-cuda-sys/doc_headers/cuda_include/cuda_device_runtime_api.h:104
↓ 3 callers
Function
cudaOccupancyMaxPotentialBlockSizeVariableSMemWithFlags
kn-cuda-sys/doc_headers/cuda_include/cuda_runtime.h:1749
↓ 3 callers
Method
define
(&mut self, key: &'a str, value: T)
kn-graph/src/onnx/store.rs:14
↓ 3 callers
Function
define_tensor_data
( graph: &mut Graph, name: &str, tensor: &TensorProto, external: &mut dyn ExternalDataLoader,
kn-graph/src/onnx/load.rs:1230
↓ 3 callers
Method
descriptor
(&self, dtype: cudnnDataType_t)
kn-cuda-eval/src/shape.rs:241
↓ 3 callers
Method
div_rem
(self, rhs: impl Into<Size>)
kn-graph/src/shape.rs:303
↓ 3 callers
Method
finish
(self, old_input: Value)
kn-graph/src/optimizer/affine.rs:151
↓ 3 callers
Function
fuse_affine_list
(channels: usize, operations: &[AffineOperation])
kn-graph/src/optimizer/affine.rs:352
↓ 3 callers
Method
has_simple_strides
(&self)
kn-cuda-eval/src/shape.rs:65
↓ 3 callers
Function
heap_recurse
Trick to avoid stackoverflow on deep graphs: We don't recuse at all, and if we would have wanted to to recurse we return `Err` instead. This function
kn-graph/src/optimizer/recurse.rs:6
↓ 3 callers
Method
inner
(&self)
kn-cuda-sys/src/wrapper/event.rs:31
↓ 3 callers
Method
insert_mapping
(&mut self, value: Value, result: PlanTensor)
kn-cuda-eval/src/planner.rs:656
↓ 3 callers
Method
is_const_zero
(&self, value: Value)
kn-graph/src/graph.rs:481
↓ 3 callers
Method
keep
Build a new shape with the shape at `axis` kept and all other axes replaced by `rest`.
kn-graph/src/shape.rs:165
↓ 3 callers
Method
layernorm
(&mut self, input: Value, axis: usize, eps: f32)
kn-graph/src/graph.rs:1136
↓ 3 callers
Method
load
(self)
kn-graph/src/onnx/loader.rs:102
↓ 3 callers
Method
load_operand_y
(&mut self, operand: &PlanTensor)
kn-cuda-eval/src/planner.rs:1055
↓ 3 callers
Function
manual_tensor
(shape: I, data: Vec<T>)
kn-cuda-eval/tests/root/tensor_utils.rs:13
↓ 3 callers
Method
mul
(self, rhs: Self)
kn-graph/src/onnx/typed_value.rs:249
↓ 3 callers
Method
permute
(&mut self, input: Value, permutation: Vec<usize>)
kn-graph/src/graph.rs:723
↓ 3 callers
Method
plan_copy_tensor
TODO participate in scalar fusion
kn-cuda-eval/src/planner.rs:940
↓ 3 callers
Method
pow
(&mut self, left: Value, right: Value)
kn-graph/src/graph.rs:1242
↓ 3 callers
Method
prepare
(&self, graph: Graph, batch_size: usize)
kn-runtime/src/lib.rs:85
↓ 3 callers
Function
resolve_dtype
(data_type: DataType, node: &str)
kn-graph/src/onnx/load.rs:1364
↓ 3 callers
Method
run
(&self, handles: &Handles)
kn-cuda-eval/src/step.rs:342
↓ 3 callers
Function
run_tensor_op
Runs `output = op(alpha_1 * input_1, alpha_2 * input_2) + b * output`
kn-cuda-sys/src/wrapper/operation.rs:268
↓ 3 callers
Function
simple_strides
(shape: &[usize])
kn-cuda-eval/src/shape.rs:294
↓ 3 callers
Function
slice_info
( rank: usize, axis: usize, start: isize, end: Option<isize>, step: isize, )
kn-graph/src/cpu.rs:481
↓ 3 callers
Method
sum
(mut iter: I)
kn-graph/src/shape.rs:490
↓ 3 callers
Function
tensor_to_image
(tensor: &Tensor<f32>)
kn-runtime/examples/stable_diffusion.rs:238
↓ 3 callers
Function
test_all_exact_graph
TODO remove references to this
kn-cuda-eval/tests/root/runner.rs:29
↓ 3 callers
Method
to_mat_mul_arg
TODO move this somewhere else, this is pretty random
kn-cuda-eval/src/offset_tensor.rs:118
↓ 3 callers
Function
unwrap_1
(slice: &[i64])
kn-graph/src/onnx/load.rs:1402
↓ 3 callers
Method
unwrap_1
(&self)
kn-graph/src/shape.rs:103
↓ 3 callers
Method
unwrap_3
(&self)
kn-graph/src/shape.rs:115
↓ 3 callers
Method
visit_ensure_simple_strides
(&mut self, value: Value)
kn-cuda-eval/src/planner.rs:575
↓ 2 callers
Function
__bfloat162char_rz
kn-cuda-sys/doc_headers/cuda_include/cuda_bf16.hpp:1309
↓ 2 callers
Function
__bfloat162int_rz
kn-cuda-sys/doc_headers/cuda_include/cuda_bf16.hpp:1249
↓ 2 callers
Function
__bfloat162ll_rz
defined(__CUDACC__) || defined(_NVHPC_CUDA) */
kn-cuda-sys/doc_headers/cuda_include/cuda_bf16.hpp:1950
↓ 2 callers
Function
__bfloat162uchar_rz
kn-cuda-sys/doc_headers/cuda_include/cuda_bf16.hpp:1343
↓ 2 callers
Function
__bfloat162uint_rz
kn-cuda-sys/doc_headers/cuda_include/cuda_bf16.hpp:1571
↓ 2 callers
Function
__bfloat162ull_rz
defined(__CUDACC__) || defined(_NVHPC_CUDA) */
kn-cuda-sys/doc_headers/cuda_include/cuda_bf16.hpp:1810
↓ 2 callers
Function
__double2half
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:1001
↓ 2 callers
Function
__half2char_rz
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:1335
↓ 2 callers
Function
__half2int_rz
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:1450
↓ 2 callers
Function
__half2ll_rz
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:1504
↓ 2 callers
Function
__half2uchar_rz
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:1366
↓ 2 callers
Function
__half2uint_rz
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:1477
↓ 2 callers
Function
__half2ull_rz
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:1531
↓ 2 callers
Function
__high2half
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:2135
↓ 2 callers
Function
__hmin_nan
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:3900
↓ 2 callers
Function
__internal_sin_cos_kernel
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:3467
↓ 2 callers
Function
__internal_trig_reduction_kernel
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:3457
↓ 2 callers
Function
__short2half_rn
defined(__CUDACC__) || defined(_NVHPC_CUDA) */
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:1677
↓ 2 callers
Function
__ushort2half_rn
defined(__CUDACC__) || defined(_NVHPC_CUDA) */
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:1809
↓ 2 callers
Method
alloc_buffer_shared
TODO add skip for zero-sized buffers?
kn-cuda-eval/src/planner.rs:983
↓ 2 callers
Method
alloc_y
(&mut self)
kn-cuda-eval/src/planner.rs:1031
↓ 2 callers
Method
apply
(self, graph: &mut Graph, input: Value)
kn-graph/src/optimizer/affine.rs:331
↓ 2 callers
Method
as_fixed
(&self)
kn-graph/src/shape.rs:80
↓ 2 callers
Method
assert_in_bounds
(self, size: usize)
kn-graph/src/graph.rs:1585
↓ 2 callers
Method
assert_valid
(self)
kn-graph/src/graph.rs:1568
↓ 2 callers
Method
attribute
(self, attribute: cudaDeviceAttr)
kn-cuda-sys/src/wrapper/handle.rs:78
↓ 2 callers
Function
binary_op_str
(op: BinaryOp, a: &str, b: &str)
kn-cuda-eval/src/planner.rs:1139
↓ 2 callers
Method
broadcast
(&self, new_shape: Vec<usize>)
kn-cuda-eval/src/shape.rs:106
↓ 2 callers
Function
broadcast_tensors_symmetric
( left: &'l Tensor<L>, right: &'r Tensor<R>, )
kn-graph/src/graph.rs:1450
↓ 2 callers
Function
calculate_auto_padding
(graph: &Graph, conv_rank: usize, input: Value, filter: Value, strides: &[i64], dilations: &[i64], up: bool)
kn-graph/src/onnx/load.rs:1201
↓ 2 callers
Function
check_tensor_match_approx
( i: usize, expected_output: &Tensor<f64>, output: &Tensor<f64>, counts: &mut Counts, firs
kn-cuda-eval/src/tester.rs:251
↓ 2 callers
Method
clamp_dyn
(&mut self, input: Value, min: DScalar, max: DScalar)
kn-graph/src/graph.rs:1193
↓ 2 callers
Function
complex_multiply
(new_axis: bool)
kn-cuda-eval/tests/root/graphs.rs:971
↓ 2 callers
Method
compute_capability
(self)
kn-cuda-sys/src/wrapper/handle.rs:86
↓ 2 callers
Function
concatenate
Wrapper around [ndarray::concatenate()] that can handle an empty input list.
kn-graph/src/cpu.rs:336
↓ 2 callers
Method
copy_linear_from_device
(&self, other: &DevicePtr, len_bytes: usize)
kn-cuda-sys/src/wrapper/mem/device.rs:155
↓ 2 callers
Method
copy_simple_from_host
(&self, buffer: &[u8])
kn-cuda-eval/src/device_tensor.rs:39
↓ 2 callers
Method
copy_simple_to_host
(&self, buffer: &mut [u8])
kn-cuda-eval/src/device_tensor.rs:55
↓ 2 callers
Function
cpu_slice
(input: &Tensor<T>, axis: usize, range: SliceRange)
kn-graph/src/cpu.rs:286
↓ 2 callers
Function
cudaFuncGetAttributes
kn-cuda-sys/doc_headers/cuda_include/cuda_device_runtime_api.h:84
↓ 2 callers
Function
cudaGetDevice
kn-cuda-sys/doc_headers/cuda_include/cuda_device_runtime_api.h:94
↓ 2 callers
Function
cudaMalloc
kn-cuda-sys/doc_headers/cuda_include/cuda_device_runtime_api.h:79
↓ 2 callers
Function
cudaMemcpyAsync
kn-cuda-sys/doc_headers/cuda_include/cuda_device_runtime_api.h:474
↓ 2 callers
Function
cuda_device_count
()
kn-cuda-sys/src/wrapper/handle.rs:104
↓ 2 callers
Method
define_y_simple
Define a new y value, computed by `expression`. The expression is not allowed to do any memory accesses, it should only use existing `y` values.
kn-cuda-eval/src/planner.rs:1070
↓ 2 callers
Method
device
(&self)
kn-cuda-sys/src/wrapper/handle.rs:141
↓ 2 callers
Method
eval
(&mut self, inputs: Vec<&PyUntypedArray>, py: Python<'py>)
kn-python/src/lib.rs:72
↓ 2 callers
Function
eval_cudnn
(graph: &Graph, batch_size: usize, inputs: &[DTensor], print_executor: bool)
kn-cuda-eval/src/tester.rs:20
↓ 2 callers
Function
float
* Type cast to \p float operator. */
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:338
↓ 2 callers
Function
fmt_shape_impl
(f: &mut Formatter, dims: &[impl Display])
kn-graph/src/shape.rs:554
↓ 2 callers
Method
follow_if
( &self, start: Value, mut next: impl FnMut(&Graph, Value, &Operation) -> VisitResult<
kn-graph/src/optimizer/core.rs:301
↓ 2 callers
Method
for_each_continuous_group
(&self, mut f: impl FnMut(usize, isize))
kn-cuda-eval/src/shape.rs:189
↓ 2 callers
Method
from_bytes
(bytes: &[u8])
kn-python/src/lib.rs:35
↓ 2 callers
Method
get_function_by_lower_name
It's probably easier to use [CompileResult::get_function_by_name] if possible.
kn-cuda-sys/src/wrapper/rtc/core.rs:198
↓ 2 callers
Method
has_stride
(&self)
kn-graph/src/graph.rs:345
↓ 2 callers
Function
hceil
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:1996
↓ 2 callers
Function
hfloor
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:2002
↓ 2 callers
Function
hrint
kn-cuda-sys/doc_headers/cuda_include/cuda_fp16.hpp:2008
← previous
next →
201–300 of 1,306, ranked by callers