Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/Ao-Lee/Reinforcement-Learning-David-Silver-Solution
/ functions
Functions
38 in github.com/Ao-Lee/Reinforcement-Learning-David-Silver-Solution
⨍
Functions
38
◇
Types & classes
1
↓ 11 callers
Function
IsTerminalState
(s)
env.py:62
↓ 5 callers
Method
EvaluateQValue
(self, s, a)
Function_Approximation.py:22
↓ 5 callers
Function
InitState
()
env.py:14
↓ 5 callers
Function
Print2DFunction
(V, range_x, range_y, title='', path=None)
plot.py:9
↓ 5 callers
Function
StateToCoord
(state)
env.py:65
↓ 4 callers
Function
Approximator2Q
(app)
Function_Approximation.py:118
↓ 4 callers
Function
DrawCard
(must_be_black=False)
env.py:7
↓ 4 callers
Function
GetFilePath
(name)
TD_Learning.py:67
↓ 4 callers
Function
GetFilePath
(name)
Function_Approximation.py:130
↓ 4 callers
Function
MyPolicy
(state, Q, history, n0=100)
policy.py:18
↓ 3 callers
Function
GetQvalue
()
MC_Control.py:67
↓ 3 callers
Function
SARSA_TDLambda
(lmbda, iteration, Qstar=None)
TD_Learning.py:43
↓ 3 callers
Function
SARSA_TDLambda
(lmbda, iteration, Qstar=None)
Function_Approximation.py:94
↓ 3 callers
Function
Step
(s1, a1)
env.py:53
↓ 3 callers
Function
ToFeature
(s, a)
Function_Approximation.py:63
↓ 2 callers
Function
EpsilonGreedyPolicy
(state, epsilon, approximator)
Function_Approximation.py:31
↓ 2 callers
Function
GetQValue
(Q, s, a)
TD_Learning.py:13
↓ 2 callers
Function
PrintLambdaMSE
(lmbda, mse, title='', path=None)
plot.py:24
↓ 2 callers
Function
PrintLoss
(losses, tags, title='', path=None)
plot.py:33
↓ 2 callers
Function
Update_TDLambda
(Q, eligibility, history, s1, a1, r2, s2, a2, lmbda)
TD_Learning.py:22
↓ 2 callers
Function
Update_TDLambda
(approximator, eligibility, s1, a1, r2, s2, a2, lmbda)
Function_Approximation.py:81
↓ 1 callers
Function
EpsilonGreedyPolicy
(state, epsilon, Q)
policy.py:5
↓ 1 callers
Function
GenerateEpisode
(Q, history)
MC_Control.py:14
↓ 1 callers
Function
GetFilePath
(name)
MC_Control.py:72
↓ 1 callers
Function
OptimizeQValue
(Q)
MC_Control.py:55
↓ 1 callers
Function
Section2_Monte_Carlo_Control
()
MC_Control.py:77
↓ 1 callers
Function
Section3Question1
(Qstar)
TD_Learning.py:72
↓ 1 callers
Function
Section3Question2
(Qstar)
TD_Learning.py:83
↓ 1 callers
Function
Section4Question1
(Qstar)
Function_Approximation.py:135
↓ 1 callers
Function
Section4Question2
(Qstar)
Function_Approximation.py:148
↓ 1 callers
Function
UpdateQ_MC
(Q, simulation, history)
MC_Control.py:38
↓ 1 callers
Method
UpdateWeights
(self, new_w)
Function_Approximation.py:18
↓ 1 callers
Function
_GetDealerMask
(n)
Function_Approximation.py:46
↓ 1 callers
Function
_GetPlayerMask
(n)
Function_Approximation.py:53
↓ 1 callers
Function
_StepHit
(s1)
env.py:21
↓ 1 callers
Function
_StepStick
(s1)
env.py:31
Function
_TestFeature
()
Function_Approximation.py:72
Method
__init__
(self)
Function_Approximation.py:15