(input_, dim, kernel_size)
| 240 | |
| 241 | |
| 242 | def _drop_from_previous_rank(input_, dim, kernel_size): |
| 243 | input_ = input_.transpose(0, dim)[kernel_size - 1 :].transpose(0, dim) |
| 244 | return input_ |
| 245 | |
| 246 | |
| 247 | class _ConvolutionScatterToContextParallelRegion(torch.autograd.Function): |