MCPcopy Create free account

hub / github.com/TJU-DRL-LAB/AI-Optimizer / functions

Functions3,230 in github.com/TJU-DRL-LAB/AI-Optimizer

↓ 4 callersMethodsample_n_without_squash
(self, x: torch.Tensor, n: int)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/imitators.py:117
↓ 4 callersMethodsave
(self, filename)
modelbased-rl/PlaNet/planet/tools/attr_dict.py:123
↓ 4 callersMethodseed
(self, n=None)
multiagent-rl/easy-marl/envs/discrete_magym/envs/combat/combat.py:508
↓ 4 callersMethodset_description
(self, params=[])
modelbased-rl/MBPO/ED2-MBPO/mbpo/utils/logging.py:46
↓ 4 callersMethodsubmit
Submit a single or batch tensor to refine the streaming mean.
modelbased-rl/PlaNet/planet/tools/streaming_mean.py:56
↓ 4 callersMethodtrain
(self, *args, **kwargs)
modelbased-rl/BMPO/bmpo.py:325
↓ 4 callersMethodtrain
(self, batch_experience_dict)
multiagent-rl/easy-marl/algorithms/DQN_based/VDN.py:84
↓ 4 callersMethodupdate_actor
(self, batch: TorchMiniBatch)
offline-rl-algorithms/COMBO/t.py:342
↓ 4 callersMethodupdate_critic
(self, batch: TorchMiniBatch)
offline-rl-algorithms/COMBO/t.py:296
↓ 4 callersMethodupdate_imitator
(self, batch: TorchMiniBatch)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/bcq_impl.py:150
↓ 3 callersMethod__create_grid
(self)
multiagent-rl/easy-marl/envs/discrete_magym/envs/predator_prey/predator_prey.py:89
↓ 3 callersMethod__create_grid
(self)
multiagent-rl/easy-marl/envs/discrete_magym/envs/switch/switch_one_corridor.py:76
↓ 3 callersMethod__init__
(self, orient='H', axis_pos=0.0, endpoints=(-1, 1), width=0.1, hard=True)
multiagent-rl/easy-marl/envs/continuous_mpe/multiagent/core.py:28
↓ 3 callersMethod__init__
(self, env: gym.Env, is_eval: bool = False)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/envs/wrappers.py:260
↓ 3 callersMethod__init__
( self, encoder_encoder: EncoderWithAction, decoder_encoder: EncoderWithAction,
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/imitators.py:26
↓ 3 callersMethod__init__
( self, observation_shape: Sequence[int], filters: Optional[List[Sequence[int]]] = Non
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/encoders.py:79
↓ 3 callersMethod__init__
(self, encoder: Encoder, action_size: int)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/policies.py:267
↓ 3 callersMethod__update_agent_view
(self, agent_i)
multiagent-rl/easy-marl/envs/discrete_magym/envs/traffic_junction/traffic_junction.py:168
↓ 3 callersMethod__update_agent_view
(self, agent_i)
multiagent-rl/easy-marl/envs/discrete_magym/envs/pong_duel/pong_duel.py:56
↓ 3 callersFunction_assert_action_space
(algo: LearnableBase, env: gym.Env)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/base.py:20
↓ 3 callersMethod_clean_particles
(self, all)
modelbased-rl/SampledMuZero/games/lunarlander.py:461
↓ 3 callersMethod_compute_mmd_loss
(self, obs_t: torch.Tensor)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/bear_impl.py:189
↓ 3 callersMethod_compute_mmd_loss
(self, obs_t: torch.Tensor)
offline-rl-algorithms/UWAC/uwac_impl.py:236
↓ 3 callersMethod_compute_quantiles
( self, h: torch.Tensor, taus: torch.Tensor )
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/q_functions/qr_q_function.py:37
↓ 3 callersMethod_compute_quantiles
( self, h: torch.Tensor, taus: torch.Tensor )
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/q_functions/qr_q_function.py:110
↓ 3 callersMethod_compute_quantiles
( self, h: torch.Tensor, taus: torch.Tensor )
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/q_functions/iqn_q_function.py:83
↓ 3 callersMethod_compute_quantiles
( self, h: torch.Tensor, taus: torch.Tensor )
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/q_functions/iqn_q_function.py:177
↓ 3 callersMethod_get_obs
(self)
multiagent-rl/easy-marl/envs/continuous_mpe/mpe_env.py:63
↓ 3 callersFunction_get_params_json_path
(path: str)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/cli.py:197
↓ 3 callersMethod_make_taus
(self, h: torch.Tensor)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/q_functions/iqn_q_function.py:76
↓ 3 callersMethod_make_taus
(self, h: torch.Tensor)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/q_functions/iqn_q_function.py:170
↓ 3 callersMethod_neighbour_agents
(self, pos)
multiagent-rl/easy-marl/envs/discrete_magym/envs/predator_prey/predator_prey.py:226
↓ 3 callersMethod_process_observation_shape
( self, observation_shape: Sequence[int] )
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/base.py:732
↓ 3 callersMethod_read_ping
Read the duration since the last PING was written. Returns: Tuple of worker who wrote the last ping and duration until then. Raises:
modelbased-rl/PlaNet/planet/training/running.py:286
↓ 3 callersFunction_read_spec
( reader, directory, return_length=False, numpy_types=False)
modelbased-rl/PlaNet/planet/tools/numpy_episodes.py:146
↓ 3 callersFunction_sample
(sequence, amount)
modelbased-rl/PlaNet/planet/tools/numpy_episodes.py:171
↓ 3 callersFunction_setup_algo
(algo: AlgoProtocol, env: gym.Env)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/online/iterators.py:89
↓ 3 callersMethod_train_target_network_hard
(self)
multiagent-rl/easy-marl/algorithms/DQN_based/CommNet.py:166
↓ 3 callersMethod_train_target_network_hard
(self)
multiagent-rl/easy-marl/algorithms/DQN_based/QMIX.py:180
↓ 3 callersMethod_train_target_network_hard
(self)
multiagent-rl/easy-marl/algorithms/DQN_based/VDN.py:149
↓ 3 callersMethod_train_target_network_hard
(self)
multiagent-rl/easy-marl/algorithms/DQN_based/IDQN.py:132
↓ 3 callersMethodaction_history
(self, idx=None)
modelbased-rl/MuZero/core/game.py:141
↓ 3 callersFunctionbinning
(xs, ys, bins, reducer)
modelbased-rl/Dreamer/Vanilla_Dreamer/plotting.py:211
↓ 3 callersMethodcall
(self, name, *args, **kwargs)
modelbased-rl/Dreamer/Vanilla_Dreamer/wrappers.py:404
↓ 3 callersMethodclip_episode
Clips the current episode.
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/online/buffers.py:105
↓ 3 callersMethodclose
(self)
modelbased-rl/MBPO/ED2-MBPO/mbpo/utils/logging.py:141
↓ 3 callersMethodclose
(self)
multiagent-rl/easy-marl/envs/discrete_magym/envs/combat/combat.py:512
↓ 3 callersMethodclose
(self)
multiagent-rl/easy-marl/envs/continuous_mpe/multiagent/rendering.py:66
↓ 3 callersMethodcommit
(self, epoch: int, step: int)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/logger.py:115
↓ 3 callersFunctioncreate_categorical_policy
( observation_shape: Sequence[int], action_size: int, encoder_factory: EncoderFactory, )
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/builders.py:109
↓ 3 callersFunctioncreate_deterministic_policy
( observation_shape: Sequence[int], action_size: int, encoder_factory: EncoderFactory, )
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/builders.py:72
↓ 3 callersMethodcreate_prediction_tensors
See predict() above for documentation.
modelbased-rl/MBPO/ED2-MBPO/mbpo/models/bnn.py:543
↓ 3 callersMethoddist
(self, x: torch.Tensor)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/policies.py:165
↓ 3 callersMethoddivergence_from_states
Compute the divergence measure between two states.
modelbased-rl/PlaNet/planet/models/ssm.py:75
↓ 3 callersMethoddraw_polygon
(self, v, filled=True, **attrs)
multiagent-rl/easy-marl/envs/continuous_mpe/multiagent/rendering.py:121
↓ 3 callersMethodencode
(self, x: torch.Tensor, action: torch.Tensor)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/imitators.py:63
↓ 3 callersMethodentropy
(self)
modelbased-rl/Dreamer/Vanilla_Dreamer/tools.py:244
↓ 3 callersMethodexpand
We expand a node using the value, reward and policy prediction obtained from the neural network.
modelbased-rl/SampledMuZero/self_play.py:447
↓ 3 callersMethodfinalize
Finalizes the network. Arguments: optimizer: (tf.train.Optimizer) An optimizer class from those available at tf.train.Optimizer.
modelbased-rl/BMPO/models/bnn.py:144
↓ 3 callersMethodforward
(self, x: torch.Tensor)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/q_functions/mean_q_function.py:23
↓ 3 callersMethodfoward_agent_i
(self, observation, agent_id)
multiagent-rl/easy-marl/algorithms/PPO_based/MAPPO.py:43
↓ 3 callersMethodget_agent_obs
Returns list of observations for each agent.
multiagent-rl/easy-marl/envs/discrete_magym/envs/lumberjacks/lumberjacks.py:233
↓ 3 callersFunctionget_mode
Get the (transformed) mode of the distribution. Borrowed from https://github.com/HorizonRobotics/alf/blob/0f8d0ec5d60ef6f30307c6a66ba388852e8c
offline-rl-algorithms/E2O/PEX-main/pex/utils/util.py:188
↓ 3 callersMethodget_params
Returns the all attributes. This method returns the all attributes including ones in subclasses. Some of scikit-learn utilities will
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/base.py:267
↓ 3 callersMethodget_vars
Returns the variables of this layer.
modelbased-rl/MBPO/ED2-MBPO/mbpo/models/fc.py:158
↓ 3 callersMethodgood_agents
(self, world)
multiagent-rl/easy-marl/envs/continuous_mpe/multiagent/scenarios/simple_world_comm.py:134
↓ 3 callersMethodinitial
(self, batch_size)
modelbased-rl/Dreamer/ED2-Dreamer/models.py:20
↓ 3 callersMethodinitial
(self, batch_size)
modelbased-rl/Dreamer/Vanilla_Dreamer/models.py:20
↓ 3 callersMethodinitial_inference
(self, observation)
modelbased-rl/SampledMuZero/models.py:46
↓ 3 callersMethodis_collision
(self, agent1, agent2)
multiagent-rl/easy-marl/envs/continuous_mpe/multiagent/scenarios/simple_tag.py:69
↓ 3 callersMethodis_fireable
Checks if the target_pos is in the firing range(5x5) :param source_pos: Coordinates of the source :param target_pos: Coordin
multiagent-rl/easy-marl/envs/discrete_magym/envs/combat/combat.py:342
↓ 3 callersMethodlegal_actions
(self)
modelbased-rl/MuZero/core/game.py:72
↓ 3 callersFunctionmake_circle
(radius=10, res=30, filled=True)
multiagent-rl/easy-marl/envs/continuous_mpe/multiagent/rendering.py:243
↓ 3 callersMethodmean
(self)
modelbased-rl/Dreamer/Vanilla_Dreamer/tools.py:235
↓ 3 callersMethodonnx_safe_sample_n
(self, x: torch.Tensor, n: int)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/policies.py:231
↓ 3 callersMethodpolicy
(self)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/bc_impl.py:166
↓ 3 callersMethodpredict
(self, x: Union[np.ndarray, List[Any]])
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/online/explorers.py:11
↓ 3 callersMethodpredict_with_variance
( self, x: torch.Tensor, action: torch.Tensor )
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/dynamics.py:102
↓ 3 callersFunctionregister_scaler
Registers scaler class. Args: cls: scaler class inheriting ``Scaler``.
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/preprocessing/scalers.py:384
↓ 3 callersMethodrender
(self, *args, **kwargs)
modelbased-rl/PlaNet/planet/control/wrappers.py:221
↓ 3 callersMethodrender
(self, *args, **kwargs)
modelbased-rl/MuZero/core/game.py:165
↓ 3 callersFunctionrun_example_local
Run example locally, potentially parallelizing across cpus/gpus.
modelbased-rl/MBPO/ED2-MBPO/examples/instrument.py:201
↓ 3 callersMethodsample
(self)
multiagent-rl/easy-marl/buffer.py:39
↓ 3 callersMethodsave
Saves all information required to recreate this model in two files in savedir (or self.model_dir if savedir is None), one containing the model
modelbased-rl/MBPO/ED2-MBPO/mbpo/models/bnn.py:554
↓ 3 callersMethodsave_model
(self, model_dir)
multiagent-rl/easy-marl/algorithms/DQN_based/VDN.py:167
↓ 3 callersMethodselect_action
(self, observations, evaluate=False, return_all_actions=False)
offline-rl-algorithms/E2O/PEX-main/pex/algorithms/pex.py:47
↓ 3 callersMethodset_bounds
(self, left, right, bottom, top)
multiagent-rl/easy-marl/envs/continuous_mpe/multiagent/rendering.py:72
↓ 3 callersMethodset_description
(self, params=[])
modelbased-rl/BMPO/utils/logging.py:46
↓ 3 callersFunctionset_seed
(seed, env=None)
offline-rl-algorithms/E2O/PEX-main/pex/utils/util.py:172
↓ 3 callersMethodset_translation
(self, newx, newy)
multiagent-rl/easy-marl/envs/continuous_mpe/multiagent/rendering.py:188
↓ 3 callersFunctionsoft_sync
(targ_model: nn.Module, model: nn.Module, tau: float)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/torch_utility.py:27
↓ 3 callersMethodstep
(self, obs, act, deterministic=False)
modelbased-rl/MBPO/ED2-MBPO/mbpo/models/fake_env.py:33
↓ 3 callersMethodstep
Apply action to the game. Args: action : action of the action_space to take. Returns: The n
modelbased-rl/SampledMuZero/games/atari.py:145
↓ 3 callersMethodstep
(self, action)
modelbased-rl/MuZero/core/game.py:75
↓ 3 callersFunctiontorchify
(x)
offline-rl-algorithms/E2O/PEX-main/pex/utils/util.py:32
↓ 3 callersMethodunlock
(self)
modelbased-rl/PlaNet/planet/tools/attr_dict.py:101
↓ 3 callersMethodupdate
(self, value)
modelbased-rl/SampledMuZero/self_play.py:555
↓ 3 callersMethodupdate_target
(self)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/dqn_impl.py:146
↓ 3 callersMethodupdate_temp
( self, batch: TorchMiniBatch )
offline-rl-algorithms/COMBO/t.py:125
↓ 2 callersMethod__create_grid
(self)
multiagent-rl/easy-marl/envs/discrete_magym/envs/traffic_junction/traffic_junction.py:272
← previousnext →201–300 of 3,230, ranked by callers