| 82 | return self.step_counter |
| 83 | |
| 84 | def set_data_worker_logs(self, eps_len, eps_len_max, eps_ori_reward, eps_reward, eps_reward_max, temperature, visit_entropy, priority_self_play, distributions): |
| 85 | self.eps_lengths.append(eps_len) |
| 86 | self.eps_lengths_max.append(eps_len_max) |
| 87 | self.ori_reward_log.append(eps_ori_reward) |
| 88 | self.reward_log.append(eps_reward) |
| 89 | self.reward_max_log.append(eps_reward_max) |
| 90 | self.temperature_log.append(temperature) |
| 91 | self.visit_entropies_log.append(visit_entropy) |
| 92 | self.priority_self_play_log.append(priority_self_play) |
| 93 | |
| 94 | for key, val in distributions.items(): |
| 95 | if key not in self.distributions_log.keys(): |
| 96 | self.distributions_log[key] = [] |
| 97 | self.distributions_log[key] += val |
| 98 | |
| 99 | def add_test_log(self, test_counter, test_dict): |
| 100 | self.test_counter = test_counter |