Method__init__(self, sess, action_dim, action_bound, learning_rate, t_replace_iter)
experiments/Solve_BipedalWalker/DDPG.py:50
Method__init__(self, sess, state_dim, action_dim, learning_rate, gamma, t_replace_iter, a, a_)
experiments/Solve_BipedalWalker/DDPG.py:109
Method__init__(self, sess, action_dim, action_bound, learning_rate, t_replace_iter)
experiments/Robot_arm/DDPG.py:60
Method__init__(self, sess, state_dim, action_dim, learning_rate, gamma, t_replace_iter, a, a_)
experiments/Robot_arm/DDPG.py:118
Method__init__(self, width, height, arm_info, point_info, point_l, mouse_in)
experiments/Robot_arm/arm_env.py:125
Method__init__(self, sess, state_dim, action_dim, learning_rate, gamma, t_replace_iter, a, a_)
experiments/2D_car/DDPG.py:113
Method__init__(self, actions, learning_rate=0.01, reward_decay=0.9, e_greedy=0.9, trace_decay=0.9)
contents/4_Sarsa_lambda_maze/RL_brain.py:51
Method__init__(self, sess, action_dim, action_bound, learning_rate, replacement)
contents/9_Deep_Deterministic_Policy_Gradient_DDPG/DDPG.py:44
Method__init__(self, sess, state_dim, action_dim, learning_rate, gamma, replacement, a, a_)
contents/9_Deep_Deterministic_Policy_Gradient_DDPG/DDPG.py:112
Methodbuild_layers(s, c_names, n_l1, w_initializer, b_initializer, trainable)
contents/5.2_Prioritized_Replay_DQN/RL_brain.py:185