(
math_inst,
threadblock_shape,
thread_shape,
data_type,
layout_a,
layout_b,
layout_c,
min_cc,
align_a=32,
align_b=32,
align_c=32,
required_cuda_ver_major=9,
required_cuda_ver_minor=2,
)
| 392 | |
| 393 | |
| 394 | def GeneratesGemv( |
| 395 | math_inst, |
| 396 | threadblock_shape, |
| 397 | thread_shape, |
| 398 | data_type, |
| 399 | layout_a, |
| 400 | layout_b, |
| 401 | layout_c, |
| 402 | min_cc, |
| 403 | align_a=32, |
| 404 | align_b=32, |
| 405 | align_c=32, |
| 406 | required_cuda_ver_major=9, |
| 407 | required_cuda_ver_minor=2, |
| 408 | ): |
| 409 | element_a, element_b, element_c, element_epilogue = data_type |
| 410 | |
| 411 | A = TensorDescription(element_a, layout_a, int(align_a // DataTypeSize[element_a])) |
| 412 | B = TensorDescription(element_b, layout_b, int(align_b // DataTypeSize[element_b])) |
| 413 | C = TensorDescription(element_c, layout_c, int(align_c // DataTypeSize[element_c])) |
| 414 | return GemvBatchedStridedOperation( |
| 415 | GemmKind.GemvBatchedStrided, |
| 416 | min_cc, |
| 417 | math_inst, |
| 418 | threadblock_shape, |
| 419 | thread_shape, |
| 420 | A, |
| 421 | B, |
| 422 | C, |
| 423 | required_cuda_ver_major, |
| 424 | required_cuda_ver_minor, |
| 425 | ) |
| 426 | |
| 427 | |
| 428 | ################################################################################################### |
no test coverage detected