(self, env, rank=0)
| 245 | |
| 246 | class Monitor(gym.Wrapper): |
| 247 | def __init__(self, env, rank=0): |
| 248 | gym.Wrapper.__init__(self, env=env) |
| 249 | self.rank = rank |
| 250 | self.rewards = [] |
| 251 | self.total_reward = [] |
| 252 | self.summaries_dict = {'reward': 0, 'episode_length': 0, 'total_reward': 0, 'total_episode_length': 0} |
| 253 | env = self.env |
| 254 | while True: |
| 255 | if hasattr(env, 'was_real_done'): |
| 256 | self.episodic_env = env |
| 257 | if not hasattr(env, 'env'): |
| 258 | break |
| 259 | env = env.env |
| 260 | |
| 261 | def reset(self): |
| 262 | self.summaries_dict['reward'] = -1 |