(self)
| 573 | return next_encoded_state_normalized, reward_hidden, value_prefix |
| 574 | |
| 575 | def get_params_mean(self): |
| 576 | representation_mean = self.representation_network.get_param_mean() |
| 577 | dynamic_mean = self.dynamics_network.get_dynamic_mean() |
| 578 | reward_w_dist, reward_mean = self.dynamics_network.get_reward_mean() |
| 579 | |
| 580 | return reward_w_dist, representation_mean, dynamic_mean, reward_mean |
| 581 | |
| 582 | def project(self, hidden_state, with_grad=True): |
| 583 | # only the branch of proj + pred can share the gradients |
no test coverage detected