| 27 | |
| 28 | template <typename T> |
| 29 | void copyD2D(T *dst, const T *src, size_t n, AccessOrder order = {}) { |
| 30 | if (order.is_device()) |
| 31 | CUDA_CALL(cudaMemcpyAsync(dst, src, n*sizeof(T), cudaMemcpyDeviceToDevice, order.stream())); |
| 32 | else |
| 33 | CUDA_CALL(cudaMemcpy(dst, src, n*sizeof(T), cudaMemcpyDeviceToDevice)); |
| 34 | } |
| 35 | |
| 36 | template <typename T> |
| 37 | void copyD2H(T *dst, const T *src, size_t n, AccessOrder order = {}) { |
no test coverage detected