↓ 2 callersFunctionconstruct_forward_model(obs_dim=11, act_dim=3, rew_dim=1, hidden_dim=200, num_networks=7, num_elites=5, session=None)
modelbased-rl/BMPO/models/constructor.py:8
↓ 2 callersFunctionconstruct_model(obs_dim=11, act_dim=3, rew_dim=1, hidden_dim=200, num_networks=7, num_elites=5, session=None, action_group =
modelbased-rl/MBPO/ED2-MBPO/mbpo/models/constructor.py:7
↓ 2 callersFunctioneval_policy(env, env_name, alg, max_episode_steps, n_eval_episodes, seed)
offline-rl-algorithms/E2O/PEX-main/pex/utils/util.py:263
↓ 2 callersMethodloss_function(
value,
reward,
policy_logits,
target_value,
target_reward,
t
modelbased-rl/SampledMuZero/trainer.py:284