| 270 | return state, reward_hidden, value_prefix |
| 271 | |
| 272 | def get_dynamic_mean(self): |
| 273 | dynamic_mean = np.abs(self.conv.weight.detach().cpu().numpy().reshape(-1)).tolist() |
| 274 | |
| 275 | for block in self.resblocks: |
| 276 | for name, param in block.named_parameters(): |
| 277 | dynamic_mean += np.abs(param.detach().cpu().numpy().reshape(-1)).tolist() |
| 278 | dynamic_mean = sum(dynamic_mean) / len(dynamic_mean) |
| 279 | return dynamic_mean |
| 280 | |
| 281 | def get_reward_mean(self): |
| 282 | reward_w_dist = self.conv1x1_reward.weight.detach().cpu().numpy().reshape(-1) |