(in_channels, out_channels)
| 5 | |
| 6 | |
| 7 | def _conv1d1x1(in_channels, out_channels): |
| 8 | return nn.Sequential(nn.Conv1d(in_channels, out_channels, kernel_size=1, stride=1, bias=False), |
| 9 | nn.BatchNorm1d(out_channels)) |
| 10 | |
| 11 | |
| 12 | class GatedAxialAttention(pl.LightningModule): |