MCPcopy Create free account

hub / github.com/YeWR/EfficientZero / functions

Functions210 in github.com/YeWR/EfficientZero

↓ 78 callersMethodappend
(self, action, obs, reward)
core/game.py:125
↓ 12 callersMethodsize
(self)
core/replay_buffer.py:157
↓ 11 callersMethodinitial_inference
(self, obs)
core/model.py:81
↓ 7 callersMethodget_child
core/ctree/cnode.cpp:173
↓ 7 callersMethodput
(self, data)
core/selfplay_worker.py:39
↓ 6 callersMethodget_uniform_network
(self)
core/config.py:297
↓ 6 callersMethodinit
Initialize a history block, stack the previous stacked_observations frames. Parameters ---------- init_observations: list
core/game.py:62
↓ 5 callersMethod__init__
(self, in_channels, out_channels, momentum=0.1)
config/atari/model.py:88
↓ 5 callersMethodget_weights
(self)
core/model.py:115
↓ 5 callersMethodinverse_value_transform
(self, value_logits)
core/config.py:318
↓ 5 callersFunctionprepare_observation_lst
Prepare the observations to satisfy the input fomat of torch [B, S, W, H, C] -> [B, S x C, W, H] batch, stack num, width, height, channel
core/utils.py:307
↓ 5 callersMethodstep
(self, ac)
core/utils.py:45
↓ 5 callersMethodvalue
core/ctree/cnode.cpp:137
↓ 4 callersMethod__init__
(self, env, max_episode_steps=None)
core/utils.py:40
↓ 4 callersFunctionconv3x3
(in_channels, out_channels, stride=1)
config/atari/model.py:52
↓ 4 callersMethodproject
(self, hidden_state, with_grad=True)
config/atari/model.py:582
↓ 4 callersMethodpush
(self, batch)
core/storage.py:19
↓ 4 callersMethodrecurrent_inference
(self, hidden_state, reward_hidden, action)
core/model.py:101
↓ 4 callersMethodreset
(self, **kwargs)
core/utils.py:56
↓ 4 callersMethodsearch
Do MCTS for the roots (a batch of root nodes in parallel). Parallel in model inference Parameters ---------- roots: Any
core/mcts.py:13
↓ 4 callersMethodstep
(self, action)
core/game.py:19
↓ 4 callersMethodstep_obs
(self)
core/game.py:156
↓ 3 callersMethodclose
(self, *args, **kwargs)
core/game.py:25
↓ 3 callersMethodexpand
core/ctree/cnode.cpp:51
↓ 3 callersMethodexpanded
core/ctree/cnode.cpp:127
↓ 3 callersMethodfree
(self)
core/selfplay_worker.py:47
↓ 3 callersMethodgame_over
(self)
core/game.py:168
↓ 3 callersMethodget_distributions
core/ctree/cnode.cpp:236
↓ 3 callersMethodget_priorities
(self, i, pred_values_lst, search_values_lst)
core/selfplay_worker.py:92
↓ 3 callersMethodget_total_len
(self)
core/replay_buffer.py:171
↓ 3 callersMethodget_values
core/ctree/cnode.cpp:246
↓ 3 callersMethodinverse_reward_transform
(self, reward_logits)
core/config.py:315
↓ 3 callersFunctionmlp
MLP layers Parameters ---------- input_size: int dim of inputs layer_sizes: list dim of hidden layers output_size:
config/atari/model.py:10
↓ 3 callersMethodnormalize
core/ctree/cminimax.cpp:31
↓ 3 callersMethodobs
To obtain an observation of correct format: o[t, t + stack frames + extra len] Parameters ---------- i: int time s
core/game.py:131
↓ 3 callersMethodpop
(self)
core/storage.py:23
↓ 3 callersMethodprepare
core/ctree/cnode.cpp:204
↓ 3 callersMethodput_last_trajectory
put the last game history into the pool if the current game is finished Parameters ---------- last_game_histories: list
core/selfplay_worker.py:53
↓ 3 callersMethodreset
(self)
core/game.py:22
↓ 3 callersMethodscalar_value_loss
(self, prediction, target)
config/atari/__init__.py:158
↓ 3 callersMethodset_weights
(self, weights)
core/model.py:118
↓ 3 callersFunctiontest
evaluation test Parameters ---------- model: any models for evaluation counter: int current training step counter
core/test.py:52
↓ 3 callersMethodupdate
core/ctree/cminimax.cpp:17
↓ 2 callersMethod_phi
(self, x, min, max, set_size: int)
core/config.py:349
↓ 2 callersFunctionarr_to_str
To reduce memory usage, we choose to store the jpeg strings of image instead of the numpy array in the buffer. This function encodes the observati
core/utils.py:322
↓ 2 callersMethodclear
core/ctree/cnode.cpp:221
↓ 2 callersFunctionconcat_output
(output_lst)
core/model.py:30
↓ 2 callersFunctionconsist_loss_func
Consistency loss function: similarity loss Parameters
core/train.py:21
↓ 2 callersMethodget_len
(self)
core/storage.py:29
↓ 2 callersMethodinverse_scalar_transform
Reference from MuZerp: Appendix F => Network Architecture & Appendix A : Proposition A.2 in https://arxiv.org/pdf/1805.11593.pdf (Page-11)
core/config.py:321
↓ 2 callersFunctionmake_atari
Make Atari games Parameters ---------- env_id: str name of environment skip: int frame skip max_episode_steps: int
core/utils.py:223
↓ 2 callersMethodnew_game
returns a new instance of the game
core/config.py:293
↓ 2 callersMethodprediction
(self, state)
core/model.py:72
↓ 2 callersFunctionrenormalize
(tensor, first_dim=1)
core/model.py:134
↓ 2 callersMethodscalar_reward_loss
(self, prediction, target)
config/atari/__init__.py:155
↓ 2 callersMethodscalar_transform
Reference from MuZerp: Appendix F => Network Architecture & Appendix A : Proposition A.2 in https://arxiv.org/pdf/1805.11593.pdf (Page-11)
core/config.py:303
↓ 2 callersFunctionselect_action
select action from the root visit counts. Parameters ---------- temperature: float the temperature for the distribution determ
core/utils.py:283
↓ 2 callersMethodstore_search_stats
(self, visit_counts, root_value, idx: int = None)
core/game.py:177
↓ 2 callersFunctionstr_to_arr
To reduce memory usage, we choose to store the jpeg strings of image instead of the numpy array in the buffer. This function decodes the observati
core/utils.py:331
↓ 2 callersMethodtransform
(self, images)
core/dataset.py:41
↓ 2 callersFunctionupdate_weights
update models given a batch data Parameters ---------- model: Any EfficientZero models batch: Any a batch data inlcude
core/train.py:44
↓ 2 callersMethodzero_obs
(self)
core/game.py:152
↓ 1 callersMethod__len__
(self)
core/game.py:187
↓ 1 callersFunction_log
(config, step_count, log_data, model, replay_buffer, lr, shared_storage, summary_writer, vis_result)
core/log.py:11
↓ 1 callersMethod_prepare_policy_non_re
prepare policy targets from the non-reanalyzed context of policies
core/reanalyze_worker.py:449
↓ 1 callersMethod_prepare_policy_non_re_context
prepare the context of policies for non-reanalyzing part, just return the policy in self-play Parameters ---------- indices: l
core/reanalyze_worker.py:96
↓ 1 callersMethod_prepare_policy_re
prepare policy targets from the reanalyzed context of policies
core/reanalyze_worker.py:386
↓ 1 callersMethod_prepare_policy_re_context
prepare the context of policies for reanalyzing part Parameters ---------- indices: list transition index in repla
core/reanalyze_worker.py:119
↓ 1 callersMethod_prepare_reward_value
prepare reward and value targets from the context of rewards and values
core/reanalyze_worker.py:298
↓ 1 callersMethod_prepare_reward_value_context
prepare the context of rewards and values for reanalyzing part Parameters ---------- indices: list transition inde
core/reanalyze_worker.py:43
↓ 1 callersMethod_prepare_target_gpu
(self)
core/reanalyze_worker.py:477
↓ 1 callersMethod_remove
(self, num_excess_games)
core/replay_buffer.py:144
↓ 1 callersFunction_train
training loop Parameters ---------- model: Any EfficientZero models target_model: Any EfficientZero models for reanaly
core/train.py:327
↓ 1 callersMethodadd_exploration_noise
core/ctree/cnode.cpp:85
↓ 1 callersFunctionadjust_lr
(config, optimizer, step_count)
core/train.py:30
↓ 1 callersMethodapply_transforms
(self, transforms, image)
core/dataset.py:35
↓ 1 callersFunctioncback_propagate
core/ctree/cnode.cpp:286
↓ 1 callersFunctionconcat_output_value
(output_lst)
core/model.py:19
↓ 1 callersFunctioncselect_child
core/ctree/cnode.cpp:327
↓ 1 callersFunctioncucb_score
core/ctree/cnode.cpp:354
↓ 1 callersMethoddynamics
(self, state, reward_hidden, action)
core/model.py:78
↓ 1 callersMethodget_children_distribution
core/ctree/cnode.cpp:162
↓ 1 callersMethodget_dynamic_mean
(self)
config/atari/model.py:272
↓ 1 callersMethodget_hparams
(self)
core/config.py:364
↓ 1 callersMethodget_max_episode_steps
(self)
core/utils.py:53
↓ 1 callersMethodget_mean_q
core/ctree/cnode.cpp:96
↓ 1 callersMethodget_param_mean
(self)
config/atari/model.py:186
↓ 1 callersMethodget_params_mean
(self)
config/atari/model.py:575
↓ 1 callersMethodget_reward_mean
(self)
config/atari/model.py:281
↓ 1 callersMethodget_trajectory
core/ctree/cnode.cpp:148
↓ 1 callersMethodget_weights
(self)
core/storage.py:66
↓ 1 callersFunctioninit_logger
(base_path)
core/utils.py:268
↓ 1 callersMethodis_full
(self)
core/game.py:118
↓ 1 callersMethodlen_pool
(self)
core/selfplay_worker.py:43
↓ 1 callersMethodmake_batch
prepare the context of a batch reward_value_context: the context of reanalyzed value targets policy_re_context: the c
core/reanalyze_worker.py:161
↓ 1 callersFunctionmake_results_dir
(exp_path, args)
core/utils.py:252
↓ 1 callersMethodnew_game
(self, seed=None, save_video=False, save_path=None, video_callable=None, uid=None, test=False, final_test=Fals
config/atari/__init__.py:133
↓ 1 callersMethodpad_over
To make sure the correction of value targets, we need to add (o_t, r_t, etc) from the next history block , which is necessary for the bootstra
core/game.py:84
↓ 1 callersMethodprepare_no_noise
core/ctree/cnode.cpp:213
↓ 1 callersMethodrender
(self, *args, **kwargs)
core/game.py:28
next →1–100 of 210, ranked by callers