(kernel_name, code, **kwargs)
| 23 | |
| 24 | @cupy._util.memoize(for_each_device=True) |
| 25 | def load_kernel(kernel_name, code, **kwargs): |
| 26 | code = Template(code).substitute(**kwargs) |
| 27 | kernel_code = cupy.cuda.compile_with_cache(code) |
| 28 | return kernel_code.get_function(kernel_name) |
| 29 | |
| 30 | |
| 31 | CUDA_NUM_THREADS = 1024 |