(self)
| 54 | See https://github.com/pytorch/examples/tree/main/reinforcement_learning |
| 55 | """ |
| 56 | def __init__(self): |
| 57 | super(Policy, self).__init__() |
| 58 | self.affine1 = nn.Linear(4, 128) |
| 59 | self.dropout = nn.Dropout(p=0.6) |
| 60 | self.affine2 = nn.Linear(128, 2) |
| 61 | |
| 62 | self.saved_log_probs = [] |
| 63 | self.rewards = [] |
| 64 | |
| 65 | def forward(self, x): |
| 66 | x = self.affine1(x) |