Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/cbfinn/maml_rl
/ types & classes
Types & classes
378 in github.com/cbfinn/maml_rl
⨍
Functions
3,410
◇
Types & classes
378
↳
Endpoints
8
↓ 50 callers
Class
XmlAttr
rllab/envs/box2d/parser/xml_types.py:49
↓ 43 callers
Class
String
rllab/mujoco_py/util.py:182
↓ 32 callers
Class
TfEnv
sandbox/rocky/tf/envs/base.py:33
↓ 25 callers
Class
LinearFeatureBaseline
rllab/baselines/linear_feature_baseline.py:6
↓ 23 callers
Class
_Error
generic exception of cma module
rllab/algos/cma_es_lib.py:7316
↓ 21 callers
Class
Float
rllab/envs/box2d/parser/xml_attr_types.py:15
↓ 19 callers
Class
CartpoleEnv
rllab/envs/box2d/cartpole_env.py:10
↓ 15 callers
Class
GaussianMLPPolicy
rllab/policies/gaussian_mlp_policy.py:20
↓ 14 callers
Class
Box
A box in R^n. I.e., each coordinate is bounded.
rllab/spaces/box.py:8
↓ 13 callers
Class
TRPO
Trust Region Policy Optimization
rllab/algos/trpo.py:6
↓ 11 callers
Class
Discrete
{0,1,...,n-1}
rllab/spaces/discrete.py:7
↓ 11 callers
Class
String
rllab/envs/box2d/parser/xml_attr_types.py:103
↓ 9 callers
Class
CMAOptions
``CMAOptions()`` returns a dictionary with the available options and their default values for class ``CMAEvolutionStrategy``. ``CMAOptions('p
rllab/algos/cma_es_lib.py:4393
↓ 9 callers
Class
GaussianMLPPolicy
sandbox/rocky/tf/policies/minimal_gauss_mlp_policy.py:30
↓ 9 callers
Class
Tuple
rllab/envs/box2d/parser/xml_attr_types.py:65
↓ 9 callers
Class
VPG
Vanilla Policy Gradient.
rllab/algos/vpg.py:11
↓ 8 callers
Class
MLP
sandbox/rocky/tf/core/network.py:10
↓ 8 callers
Class
StubMethodCall
rllab/misc/instrument.py:94
↓ 8 callers
Class
ZeroBaseline
rllab/baselines/zero_baseline.py:6
↓ 6 callers
Class
Angle
rllab/envs/box2d/parser/xml_attr_types.py:109
↓ 6 callers
Class
Choice
rllab/envs/box2d/parser/xml_attr_types.py:34
↓ 6 callers
Class
MLP
rllab/core/network.py:36
↓ 6 callers
Class
ReplayPool
A utility class for experience replay. The code is adapted from https://github.com/spragunr/deep_q_rl
rllab/algos/util.py:19
↓ 6 callers
Class
XavierUniformInitializer
sandbox/rocky/tf/core/layers.py:295
↓ 5 callers
Class
CMADataLogger
data logger for class `CMAEvolutionStrategy`. The logger is identified by its name prefix and (over-)writes or reads according data files. The
rllab/algos/cma_es_lib.py:5632
↓ 5 callers
Class
Categorical
sandbox/rocky/tf/distributions/categorical.py:19
↓ 5 callers
Class
ConjugateGradientOptimizer
Performs constrained optimization via line search. The search direction is computed using a conjugate gradient algorithm, which gives x = A^{
sandbox/rocky/tf/optimizers/conjugate_gradient_optimizer.py:118
↓ 5 callers
Class
Message
rllab/misc/console.py:68
↓ 5 callers
Class
ParamLayer
rllab/core/lasagne_layers.py:9
↓ 5 callers
Class
PenaltyLbfgsOptimizer
Performs constrained optimization via penalized L-BFGS. The penalty term is adaptively adjusted to make sure that the constraint is satisfied
rllab/optimizers/penalty_lbfgs_optimizer.py:10
↓ 5 callers
Class
XmlChildren
rllab/envs/box2d/parser/xml_types.py:17
↓ 5 callers
Class
_BlancClass
blanc container class for having a collection of attributes, that might/should at some point become a more tailored class
rllab/algos/cma_es_lib.py:643
↓ 4 callers
Class
BatchDataset
rllab/optimizers/minibatch_dataset.py:4
↓ 4 callers
Class
Bool
rllab/envs/box2d/parser/xml_attr_types.py:119
↓ 4 callers
Class
Categorical
rllab/distributions/categorical.py:23
↓ 4 callers
Class
DiagonalGaussian
sandbox/rocky/tf/distributions/diagonal_gaussian.py:9
↓ 4 callers
Class
Experiment
rllab/misc/nb_utils.py:42
↓ 4 callers
Class
LbfgsOptimizer
Performs unconstrained optimization via L-BFGS.
sandbox/rocky/tf/optimizers/lbfgs_optimizer.py:11
↓ 4 callers
Class
LbfgsOptimizer
Performs unconstrained optimization via L-BFGS.
rllab/optimizers/lbfgs_optimizer.py:8
↓ 4 callers
Class
List
rllab/envs/box2d/parser/xml_attr_types.py:46
↓ 4 callers
Class
MAMLTRPO
Trust Region Policy Optimization
sandbox/rocky/tf/algos/maml_trpo.py:7
↓ 4 callers
Class
MjModel
rllab/mujoco_py/mjcore.py:29
↓ 4 callers
Class
Product
rllab/spaces/product.py:6
↓ 4 callers
Class
ProgBarCounter
rllab/sampler/stateful_pool.py:12
↓ 3 callers
Class
AntEnvRand
rllab/envs/mujoco/ant_env_rand.py:10
↓ 3 callers
Class
AntEnvRandDirec
rllab/envs/mujoco/ant_env_rand_direc.py:10
↓ 3 callers
Class
AttrDict
rllab/misc/ext.py:151
↓ 3 callers
Class
ConjugateGradientOptimizer
Performs constrained optimization via line search. The search direction is computed using a conjugate gradient algorithm, which gives x = A^{
rllab/optimizers/conjugate_gradient_optimizer.py:118
↓ 3 callers
Class
ConvNetwork
rllab/core/network.py:273
↓ 3 callers
Class
FirstOrderOptimizer
Performs (stochastic) gradient descent, possibly using fancier methods like adam etc.
sandbox/rocky/tf/optimizers/first_order_optimizer.py:17
↓ 3 callers
Class
GRUNetwork
rllab/core/network.py:195
↓ 3 callers
Class
HalfCheetahEnvRand
rllab/envs/mujoco/half_cheetah_env_rand.py:14
↓ 3 callers
Class
HalfCheetahEnvRandDirec
rllab/envs/mujoco/half_cheetah_env_rand_direc.py:15
↓ 3 callers
Class
Int
rllab/envs/box2d/parser/xml_attr_types.py:21
↓ 3 callers
Class
LSTMStepLayer
sandbox/rocky/tf/core/layers.py:1550
↓ 3 callers
Class
MAMLGaussianMLPPolicy
sandbox/rocky/tf/policies/maml_minimal_gauss_mlp_policy.py:27
↓ 3 callers
Class
OUStrategy
This strategy implements the Ornstein-Uhlenbeck process, which adds time-correlated noise to the actions taken by the deterministic policy.
rllab/exploration_strategies/ou_strategy.py:10
↓ 3 callers
Class
OrthogonalInitializer
sandbox/rocky/tf/core/layers.py:326
↓ 3 callers
Class
PenaltyLbfgsOptimizer
Performs constrained optimization via penalized L-BFGS. The penalty term is adaptively adjusted to make sure that the constraint is satisfied
sandbox/rocky/tf/optimizers/penalty_lbfgs_optimizer.py:10
↓ 3 callers
Class
PointEnvRandGoal
maml_examples/point_env_randgoal.py:7
↓ 3 callers
Class
SharedGlobal
rllab/sampler/stateful_pool.py:36
↓ 3 callers
Class
StubAttr
rllab/misc/instrument.py:77
↓ 3 callers
Class
lazydict
rllab/misc/ext.py:71
↓ 2 callers
Class
AntEnvDirecOracle
rllab/envs/mujoco/ant_env_direc_oracle.py:10
↓ 2 callers
Class
AntEnvOracle
rllab/envs/mujoco/ant_env_oracle.py:10
↓ 2 callers
Class
AntEnvRandGoal
rllab/envs/mujoco/ant_env_rand_goal.py:11
↓ 2 callers
Class
BestSolution
container to keep track of the best solution seen
rllab/algos/cma_es_lib.py:797
↓ 2 callers
Class
CMAEvolutionStrategy
CMA-ES stochastic optimizer class with ask-and-tell interface. Calling Sequences ================= es = CMAEvolutionStrategy(x0, sig
rllab/algos/cma_es_lib.py:2419
↓ 2 callers
Class
CMASolutionDict
rllab/algos/cma_es_lib.py:739
↓ 2 callers
Class
ContinuousMLPQFunction
rllab/q_functions/continuous_mlp_q_function.py:13
↓ 2 callers
Class
DDPG
Deep Deterministic Policy Gradient.
rllab/algos/ddpg.py:84
↓ 2 callers
Class
DeterministicMLPPolicy
rllab/policies/deterministic_mlp_policy.py:12
↓ 2 callers
Class
DiagonalGaussian
rllab/distributions/diagonal_gaussian.py:6
↓ 2 callers
Class
DummyEnv
tests/algos/test_trpo.py:13
↓ 2 callers
Class
ElapsedTime
using ``time.clock`` with overflow handling to measure CPU time. Example: >>> clock = ElapsedTime() # clock starts here >>> t1 = clock(
rllab/algos/cma_es_lib.py:7323
↓ 2 callers
Class
EmbeddedViewer
rllab/envs/mujoco/gather/embedded_viewer.py:11
↓ 2 callers
Class
EnvSpec
rllab/envs/env_spec.py:5
↓ 2 callers
Class
FiniteDifferenceHvp
sandbox/rocky/tf/optimizers/conjugate_gradient_optimizer.py:61
↓ 2 callers
Class
GRUNetwork
sandbox/rocky/tf/core/network.py:186
↓ 2 callers
Class
GRUStepLayer
sandbox/rocky/tf/core/layers.py:1118
↓ 2 callers
Class
GaussianMLPBaseline
rllab/baselines/gaussian_mlp_baseline.py:10
↓ 2 callers
Class
GaussianMLPPolicy
sandbox/rocky/tf/policies/gaussian_mlp_policy.py:17
↓ 2 callers
Class
GymEnv
rllab/envs/gym_env.py:47
↓ 2 callers
Class
HalfCheetahEnvDirecOracle
rllab/envs/mujoco/half_cheetah_env_direc_oracle.py:14
↓ 2 callers
Class
HalfCheetahEnvOracle
rllab/envs/mujoco/half_cheetah_env_oracle.py:14
↓ 2 callers
Class
Hex
rllab/envs/box2d/parser/xml_attr_types.py:27
↓ 2 callers
Class
LSTMNetwork
sandbox/rocky/tf/core/network.py:295
↓ 2 callers
Class
OpLayer
rllab/core/lasagne_layers.py:33
↓ 2 callers
Class
PointEnvRandGoalOracle
maml_examples/point_env_randgoal_oracle.py:7
↓ 2 callers
Class
RecurrentCategorical
sandbox/rocky/tf/distributions/recurrent_categorical.py:9
↓ 2 callers
Class
Rotation
Rotation class that implements an orthogonal linear transformation, one for each dimension. By default reach ``Rotation`` instance provides a
rllab/algos/cma_es_lib.py:7929
↓ 2 callers
Class
Selector
rllab/viskit/core.py:181
↓ 2 callers
Class
SwimmerRandGoalOracleEnv
rllab/envs/mujoco/swimmer_randgoal_oracle_env.py:10
↓ 2 callers
Class
TRPO
Trust Region Policy Optimization
sandbox/rocky/tf/algos/trpo.py:7
↓ 2 callers
Class
_CMAStopDict
keep and update a termination condition dictionary, which is "usually" empty and returned by `CMAEvolutionStrategy.stop()`. The class methods
rllab/algos/cma_es_lib.py:4781
↓ 1 callers
Class
AntEnvRandGoalOracle
rllab/envs/mujoco/ant_env_rand_goal_oracle.py:11
↓ 1 callers
Class
BatchNormLayer
sandbox/rocky/tf/core/layers.py:1726
↓ 1 callers
Class
BatchNormLayer
lasagne.layers.BatchNormLayer(incoming, axes='auto', epsilon=1e-4, alpha=0.1, mode='low_mem', beta=lasagne.init.Constant(0), gamma=lasagn
rllab/core/lasagne_layers.py:51
↓ 1 callers
Class
Bernoulli
sandbox/rocky/tf/distributions/bernoulli.py:10
↓ 1 callers
Class
BinaryOp
rllab/misc/instrument.py:65
next →
1–100 of 378, ranked by callers