Method__init__(
self,
actor,
critic,
ft_denoising_steps,
ft_denoising_steps_d=0,
model/diffusion/diffusion_vpg.py:51
Method__init__(
self,
sde,
clip_ploss_coef,
clip_vloss_coef=None,
norm_adv=True,
model/diffusion/diffusion_ppo_exact.py:45
Method__init__(
self,
actor,
critic,
network_path=None,
cql_clip_diff_min=-np.inf,
model/gaussian/gaussian_calql.py:41
Method__init__(
self,
action_dim,
horizon_steps,
cond_dim=None,
mlp_dims=[256, 256,
model/common/mlp_gmm.py:35
Method__init__(
self,
env,
n_obs_steps=1,
n_action_steps=1,
max_episode_steps=None,
env/gym_utils/wrapper/multi_step.py:108
Method__init__(self, num_envs, cliprew=10.0, gamma=0.99, epsilon=1e-8, per_env=False, device=None)
util/reward_scaling_ts.py:56