(self, shape_reward=False)
| 31 | pass |
| 32 | |
| 33 | def balance(self, shape_reward=False): |
| 34 | provided_energy = np.sum(self._info['provided_energy']) |
| 35 | absorbed_energy = np.sum(self._info['absorbed_energy']) |
| 36 | |
| 37 | if shape_reward: |
| 38 | return provided_energy, absorbed_energy, self._reward, self.shaped_reward() |
| 39 | |
| 40 | return provided_energy, absorbed_energy, self._reward, None |
| 41 | |
| 42 | def output(self): |
| 43 | return self._obs, self.shaped_reward(), self._done, self._output_info() |