Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/PKU-MARL/HARL
/ types & classes
Types & classes
185 in github.com/PKU-MARL/HARL
⨍
Functions
1,457
◇
Types & classes
185
↓ 74 callers
Class
Node
harl/envs/mamujoco/multiagent_mujoco/obsk.py:6
↓ 45 callers
Class
HyperEdge
harl/envs/mamujoco/multiagent_mujoco/obsk.py:35
↓ 22 callers
Class
PointcloudVisualizer
harl/envs/dexhands/DexterousHands/bidexhands/utils/o3dviewer.py:5
↓ 9 callers
Class
AltitudeReward
AltitudeReward Punish if current fighter doesn't satisfy some constraints. Typically negative. - Punishment of velocity when lower than s
harl/envs/lag/JSBSim/reward_functions/altitude_reward.py:5
↓ 8 callers
Class
EventDrivenReward
EventDrivenReward Achieve reward when the following event happens: - Shot down by missile: -200 - Crash accidentally: -200 - Shoo
harl/envs/lag/JSBSim/reward_functions/event_driven_reward.py:4
↓ 8 callers
Class
PostureReward
PostureReward = Orientation * Range - Orientation: Encourage pointing at enemy fighter, punish when is pointed at. - Range: Encourage get
harl/envs/lag/JSBSim/reward_functions/posture_reward.py:7
↓ 7 callers
Class
BaselineActor
harl/envs/lag/JSBSim/model/baseline_actor.py:91
↓ 6 callers
Class
PlainMLP
Plain MLP
harl/models/base/plain_mlp.py:5
↓ 4 callers
Class
MissilePostureReward
MissilePostureReward Use the velocity attenuation
harl/envs/lag/JSBSim/reward_functions/missile_posture_reward.py:5
↓ 4 callers
Class
PlainCNN
Plain CNN
harl/models/base/plain_cnn.py:6
↓ 3 callers
Class
Categorical
A linear layer followed by a Categorical distribution.
harl/models/base/distributions.py:37
↓ 3 callers
Class
ContinuousQNet
Q Network for continuous and discrete action space. Outputs the q value given global states and actions. Note that the name ContinuousQNet emphasi
harl/models/value_function_models/continuous_q_net.py:23
↓ 3 callers
Class
ExtremeState
ExtremeState End up the simulation if the aircraft is on an extreme state.
harl/envs/lag/JSBSim/termination_conditions/extreme_state.py:5
↓ 3 callers
Class
FootballEnv
harl/envs/football/football_env.py:17
↓ 3 callers
Class
GYMEnv
harl/envs/gym/gym_env.py:5
↓ 3 callers
Class
LAGEnv
harl/envs/lag/lag_env.py:11
↓ 3 callers
Class
LowAltitude
LowAltitude End up the simulation if altitude are too low.
harl/envs/lag/JSBSim/termination_conditions/low_altitude.py:5
↓ 3 callers
Class
MujocoMulti
harl/envs/mamujoco/multiagent_mujoco/mujoco_multi.py:39
↓ 3 callers
Class
Overload
Overload End up the simulation if acceleration are too high.
harl/envs/lag/JSBSim/termination_conditions/overload.py:6
↓ 3 callers
Class
PettingZooMPEEnv
harl/envs/pettingzoo_mpe/pettingzoo_mpe_env.py:11
↓ 3 callers
Class
SMACv2Env
harl/envs/smacv2/smacv2_env.py:19
↓ 3 callers
Class
SingleCombatEnv
SingleCombatEnv is an one-to-one competitive environment.
harl/envs/lag/JSBSim/envs/singlecombat_env.py:7
↓ 3 callers
Class
StarCraft2Env
The StarCraft II environment for decentralised multi-agent micromanagement scenarios.
harl/envs/smac/StarCraft2_Env.py:67
↓ 3 callers
Class
Timeout
Timeout Episode terminates if max_step steps have passed.
harl/envs/lag/JSBSim/termination_conditions/timeout.py:4
↓ 2 callers
Class
ACTLayer
MLP Module to compute actions.
harl/models/base/act.py:6
↓ 2 callers
Class
DexHandsEnv
harl/envs/dexhands/dexhands_env.py:19
↓ 2 callers
Class
DuelingQNet
Dueling Q Network for discrete action space.
harl/models/value_function_models/dueling_q_net.py:8
↓ 2 callers
Class
Flatten
harl/models/base/flatten.py:4
↓ 2 callers
Class
MLPLayer
harl/envs/lag/JSBSim/model/baseline_actor.py:12
↓ 2 callers
Class
ManeuverAgent
harl/envs/lag/JSBSim/test/test_baseline_use_obs.py:74
↓ 2 callers
Class
NormalizedActions
harl/envs/mamujoco/multiagent_mujoco/mujoco_multi.py:22
↓ 2 callers
Class
PursueAgent
harl/envs/lag/JSBSim/test/test_baseline_use_obs.py:63
↓ 2 callers
Class
RNNLayer
harl/models/base/rnn.py:8
↓ 2 callers
Class
SafeReturn
SafeReturn. End up the simulation if: - the current aircraft has been shot down. - all the enemy-aircrafts has been destroyed
harl/envs/lag/JSBSim/termination_conditions/safe_return.py:4
↓ 2 callers
Class
ShareDummyVecEnv
harl/envs/env_wrappers.py:299
↓ 2 callers
Class
ShareSubprocVecEnv
harl/envs/env_wrappers.py:220
↓ 2 callers
Class
ShootPenaltyReward
ShootPenaltyReward when launching a missile, give -10 reward for penalty, to avoid launching all missiles at once
harl/envs/lag/JSBSim/reward_functions/shoot_penalty_reward.py:4
↓ 2 callers
Class
StochasticPolicy
Stochastic policy model. Outputs actions given observations.
harl/models/policy_models/stochastic_policy.py:11
↓ 2 callers
Class
ValueNorm
Normalize a vector of observations - across the first norm_axes dimensions
harl/common/valuenorm.py:7
↓ 1 callers
Class
ACTLayer
harl/envs/lag/JSBSim/model/baseline_actor.py:69
↓ 1 callers
Class
AircraftSimulator
A class which wraps an instance of JSBSim and manages communication with it.
harl/envs/lag/JSBSim/core/simulatior.py:90
↓ 1 callers
Class
BaseTask
Base Task class. A class to subclass in order to create a task with its own observation variables, action variables, termination conditio
harl/envs/lag/JSBSim/tasks/task_base.py:8
↓ 1 callers
Class
CNNLayer
harl/models/base/cnn.py:8
↓ 1 callers
Class
Categorical
harl/envs/lag/JSBSim/model/baseline_actor.py:59
↓ 1 callers
Class
CloudpickleWrapper
Uses cloudpickle to serialize contents (otherwise multiprocessing tries to use pickle)
harl/envs/env_wrappers.py:32
↓ 1 callers
Class
DeterministicPolicy
Deterministic policy network for continuous action space.
harl/models/policy_models/deterministic_policy.py:8
↓ 1 callers
Class
DiagGaussian
A linear layer followed by a Diagonal Gaussian distribution.
harl/models/base/distributions.py:58
↓ 1 callers
Class
DodgeMissileAgent
harl/envs/lag/JSBSim/tasks/singlecombat_task.py:397
↓ 1 callers
Class
FixedCategorical
Modify standard PyTorch Categorical.
harl/models/base/distributions.py:7
↓ 1 callers
Class
FixedNormal
Modify standard PyTorch Normal.
harl/models/base/distributions.py:24
↓ 1 callers
Class
GRULayer
harl/envs/lag/JSBSim/model/baseline_actor.py:41
↓ 1 callers
Class
HeadingReward
Measure the difference between the current heading and the target heading
harl/envs/lag/JSBSim/reward_functions/heading_reward.py:6
↓ 1 callers
Class
HeadingTask
Control target heading with discrete action space
harl/envs/lag/JSBSim/tasks/heading_task.py:9
↓ 1 callers
Class
HierarchicalMultipleCombatShootTask
harl/envs/lag/JSBSim/tasks/multiplecombat_task.py:181
↓ 1 callers
Class
HierarchicalMultipleCombatShootVsBaselineTask
harl/envs/lag/JSBSim/tasks/multiplecombat_vs_baseline_task.py:96
↓ 1 callers
Class
HierarchicalMultipleCombatTask
harl/envs/lag/JSBSim/tasks/multiplecombat_task.py:134
↓ 1 callers
Class
HierarchicalMultipleCombatVsBaselineTask
harl/envs/lag/JSBSim/tasks/multiplecombat_vs_baseline_task.py:44
↓ 1 callers
Class
HierarchicalSingleCombatDodgeMissileTask
harl/envs/lag/JSBSim/tasks/singlecombat_with_missle_task.py:129
↓ 1 callers
Class
HierarchicalSingleCombatShootTask
harl/envs/lag/JSBSim/tasks/singlecombat_with_missle_task.py:203
↓ 1 callers
Class
HierarchicalSingleCombatTask
harl/envs/lag/JSBSim/tasks/singlecombat_task.py:202
↓ 1 callers
Class
MLPBase
harl/envs/lag/JSBSim/model/baseline_actor.py:31
↓ 1 callers
Class
MLPLayer
harl/models/base/mlp.py:7
↓ 1 callers
Class
ManeuverAgent
harl/envs/lag/JSBSim/test/test_baseline_use_env.py:98
↓ 1 callers
Class
ManeuverAgent
harl/envs/lag/JSBSim/tasks/singlecombat_task.py:355
↓ 1 callers
Class
MissileSimulator
harl/envs/lag/JSBSim/core/simulatior.py:329
↓ 1 callers
Class
MixedCatalog
A class to store both lag & extra properties initiated and used during lag simulation.
harl/envs/lag/JSBSim/core/catalog.py:528
↓ 1 callers
Class
MultiVecTaskPython
harl/envs/dexhands/DexterousHands/bidexhands/tasks/hand_base/multi_vec_task.py:164
↓ 1 callers
Class
MultipleCombatEnv
MultipleCombatEnv is an multi-player competitive environment.
harl/envs/lag/JSBSim/envs/multiplecombat_env.py:7
↓ 1 callers
Class
MultipleCombatTask
harl/envs/lag/JSBSim/tasks/multiplecombat_task.py:15
↓ 1 callers
Class
MultipleCombatVsBaselineTask
harl/envs/lag/JSBSim/tasks/multiplecombat_vs_baseline_task.py:13
↓ 1 callers
Class
OffPolicyBufferEP
Off-policy buffer that uses Environment-Provided (EP) state.
harl/common/buffers/off_policy_buffer_ep.py:7
↓ 1 callers
Class
OffPolicyBufferFP
Off-policy buffer that uses Feature-Pruned (FP) state. When FP state is used, the critic takes different global state as input for different actor
harl/common/buffers/off_policy_buffer_fp.py:7
↓ 1 callers
Class
OnPolicyActorBuffer
On-policy buffer for actor data storage.
harl/common/buffers/on_policy_actor_buffer.py:9
↓ 1 callers
Class
OnPolicyCriticBufferEP
On-policy buffer for critic that uses Environment-Provided (EP) state.
harl/common/buffers/on_policy_critic_buffer_ep.py:8
↓ 1 callers
Class
OnPolicyCriticBufferFP
On-policy buffer for critic that uses Feature-Pruned (FP) state. When FP state is used, the critic takes different global state as input for diffe
harl/common/buffers/on_policy_critic_buffer_fp.py:8
↓ 1 callers
Class
PursueAgent
harl/envs/lag/JSBSim/test/test_baseline_use_env.py:72
↓ 1 callers
Class
PursueAgent
harl/envs/lag/JSBSim/tasks/singlecombat_task.py:330
↓ 1 callers
Class
SingleCombatDodgeMissileTask
This task aims at training agent to dodge missile attacking
harl/envs/lag/JSBSim/tasks/singlecombat_with_missle_task.py:11
↓ 1 callers
Class
SingleCombatShootMissileTask
harl/envs/lag/JSBSim/tasks/singlecombat_with_missle_task.py:161
↓ 1 callers
Class
SingleCombatTask
harl/envs/lag/JSBSim/tasks/singlecombat_task.py:14
↓ 1 callers
Class
SingleControlEnv
SingleControlEnv is an fly-control env for single agent with no enemy fighters.
harl/envs/lag/JSBSim/envs/singlecontrol_env.py:5
↓ 1 callers
Class
SquashedGaussianPolicy
Squashed Gaussian policy network for HASAC.
harl/models/policy_models/squashed_gaussian_policy.py:14
↓ 1 callers
Class
StochasticMlpPolicy
Stochastic policy model that only uses MLP network. Outputs actions given observations.
harl/models/policy_models/stochastic_mlp_policy.py:9
↓ 1 callers
Class
StraightFlyAgent
harl/envs/lag/JSBSim/tasks/singlecombat_task.py:252
↓ 1 callers
Class
TacviewClient
harl/envs/lag/JSBSim/core/render_tacview.py:19
↓ 1 callers
Class
UnreachHeading
UnreachHeading [0, 1] End up the simulation if the aircraft didn't reach the target heading or attitude in limited time.
harl/envs/lag/JSBSim/termination_conditions/unreach_heading.py:6
↓ 1 callers
Class
VCritic
V Critic. Critic that learns a V-function.
harl/algorithms/critics/v_critic.py:14
↓ 1 callers
Class
VNet
V Network. Outputs value function predictions given global states.
harl/models/value_function_models/v_net.py:10
Class
AllegroHandCatchUnderarm
harl/envs/dexhands/DexterousHands/bidexhands/tasks/allegro_hand_catch_underarm.py:22
Class
AllegroHandOver
harl/envs/dexhands/DexterousHands/bidexhands/tasks/allegro_hand_over.py:22
Class
BaseEnv
A class wrapping the JSBSim flight dynamics module (FDM) for simulating aircraft as an RL environment conforming to the OpenAI Gym Env in
harl/envs/lag/JSBSim/envs/env_base.py:10
Class
BaseLogger
Base logger class. Used for logging information in the on-policy training pipeline.
harl/common/base_logger.py:8
Class
BaseRewardFunction
Base RewardFunction class Reward-specific reset and get_reward methods are implemented in subclasses
harl/envs/lag/JSBSim/reward_functions/reward_function_base.py:6
Class
BaseSimulator
harl/envs/lag/JSBSim/core/simulatior.py:16
Class
BaseTask
harl/envs/dexhands/DexterousHands/bidexhands/tasks/hand_base/base_task.py:29
Class
BaseTerminationCondition
Base TerminationCondition class Condition-specific get_termination method is implemented in subclasses
harl/envs/lag/JSBSim/termination_conditions/termination_condition_base.py:5
Class
BaselineAgent
harl/envs/lag/JSBSim/model/baseline.py:15
Class
BaselineAgent
harl/envs/lag/JSBSim/test/test_baseline_use_env.py:17
Class
BaselineAgent
harl/envs/lag/JSBSim/test/test_baseline_use_obs.py:15
Class
BaselineAgent
harl/envs/lag/JSBSim/tasks/singlecombat_task.py:270
next →
1–100 of 185, ranked by callers