MCPcopy Create free account

hub / github.com/TJU-DRL-LAB/AI-Optimizer / functions

Functions3,230 in github.com/TJU-DRL-LAB/AI-Optimizer

↓ 1 callersMethod_build_temperature
(self)
offline-rl-algorithms/COMBO/t.py:104
↓ 1 callersMethod_build_temperature
(self)
offline-rl-algorithms/COMBO/t.py:284
↓ 1 callersMethod_build_temperature_optim
(self)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/sac_impl.py:111
↓ 1 callersMethod_build_temperature_optim
(self)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/sac_impl.py:317
↓ 1 callersMethod_build_temperature_optim
(self)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/e2o_impl.py:98
↓ 1 callersMethod_build_temperature_optim
(self)
offline-rl-algorithms/REDQ/redq_impl.py:108
↓ 1 callersMethod_build_temperature_optim
(self)
offline-rl-algorithms/REDQ/redq_impl.py:288
↓ 1 callersMethod_build_temperature_optim
(self)
offline-rl-algorithms/MOPO/sac_modTH_impl.py:120
↓ 1 callersMethod_build_temperature_optim
(self)
offline-rl-algorithms/COMBO/sac_modTH_impl.py:120
↓ 1 callersMethod_build_temperature_optim
(self)
offline-rl-algorithms/COMBO/t.py:108
↓ 1 callersMethod_build_temperature_optim
(self)
offline-rl-algorithms/COMBO/t.py:288
↓ 1 callersMethod_build_value_func
(self)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/iql_impl.py:96
↓ 1 callersMethod_build_value_optim
(self)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/iql_impl.py:101
↓ 1 callersMethod_chunk
(self, l, n)
modelbased-rl/MBPO/ED2-MBPO/mbpo/utils/logging.py:112
↓ 1 callersMethod_chunk
(self, l, n)
modelbased-rl/BMPO/utils/logging.py:111
↓ 1 callersMethod_compute_advantage
( self, obs_t: torch.Tensor, act_t: torch.Tensor )
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/crr_impl.py:108
↓ 1 callersMethod_compute_conservative_loss
( self, obs_t: torch.Tensor, act_t: torch.Tensor )
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/cql_impl.py:290
↓ 1 callersMethod_compute_deterministic_target
( self, batch: TorchMiniBatch )
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/cql_impl.py:232
↓ 1 callersFunction_compute_ensemble_variance
( observations: torch.Tensor, rewards: torch.Tensor, variances: torch.Tensor, variance_type: s
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/dynamics.py:14
↓ 1 callersMethod_compute_mmd
(self, x: torch.Tensor)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/bear_impl.py:233
↓ 1 callersMethod_compute_mmd
(self, x: torch.Tensor)
offline-rl-algorithms/UWAC/uwac_impl.py:280
↓ 1 callersMethod_compute_proposal_loss
( self, h: torch.Tensor, actions: torch.Tensor, taus: torch.Tensor, ta
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/q_functions/fqf_q_function.py:127
↓ 1 callersMethod_compute_proposal_loss
( self, h: torch.Tensor, taus: torch.Tensor, taus_prime: torch.Tensor )
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/q_functions/fqf_q_function.py:251
↓ 1 callersMethod_compute_target_rem
( self, x: torch.Tensor, action: Optional[torch.Tensor] = None, reduction: str
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/q_functions/ensemble_q_function.py:191
↓ 1 callersMethod_compute_target_weighted
( self, x: torch.Tensor, action: Optional[torch.Tensor] = None, reduction: str
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/models/torch/q_functions/ensemble_q_function.py:171
↓ 1 callersMethod_compute_weight
(self, batch: TorchMiniBatch)
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/iql_impl.py:140
↓ 1 callersMethod_compute_weight
( self, obs_t: torch.Tensor, act_t: torch.Tensor )
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/crr_impl.py:98
↓ 1 callersMethod_compute_weights
( self, obs_t: torch.Tensor, act_t: torch.Tensor )
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/algos/torch/awac_impl.py:121
↓ 1 callersMethod_config_cuda
(self)
multiagent-rl/easy-marl/algorithms/DDPG_based/IDDPG.py:194
↓ 1 callersMethod_config_cuda
(self)
multiagent-rl/easy-marl/algorithms/DDPG_based/MADDPG.py:196
↓ 1 callersMethod_config_cuda
(self)
multiagent-rl/easy-marl/algorithms/PPO_based/IPPO.py:150
↓ 1 callersMethod_config_cuda
(self)
multiagent-rl/easy-marl/algorithms/PPO_based/MAPPO.py:205
↓ 1 callersMethod_config_cuda
(self)
multiagent-rl/easy-marl/algorithms/DQN_based/CommNet.py:174
↓ 1 callersMethod_config_cuda
(self)
multiagent-rl/easy-marl/algorithms/DQN_based/QMIX.py:188
↓ 1 callersMethod_config_cuda
(self)
multiagent-rl/easy-marl/algorithms/DQN_based/your_new_algorithm.py:94
↓ 1 callersMethod_config_cuda
(self)
multiagent-rl/easy-marl/algorithms/DQN_based/VDN.py:157
↓ 1 callersMethod_config_cuda
(self)
multiagent-rl/easy-marl/algorithms/DQN_based/IDQN.py:140
↓ 1 callersMethod_convert_reward
(self, reward)
modelbased-rl/PlaNet/planet/control/wrappers.py:554
↓ 1 callersFunction_convert_type
(array)
modelbased-rl/PlaNet/planet/tools/numpy_episodes.py:163
↓ 1 callersMethod_create_impl
( self, observation_shape: Sequence[int], action_size: int )
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/base.py:697
↓ 1 callersMethod_create_logger
Create a logger that prefixes messages with the current run name.
modelbased-rl/PlaNet/planet/training/running.py:359
↓ 1 callersMethod_create_session
Create a TensorFlow session with sensible default parameters. Returns: Session.
modelbased-rl/PlaNet/planet/training/trainer.py:289
↓ 1 callersFunction_data_processing
(config, params)
modelbased-rl/PlaNet/planet/scripts/configs.py:80
↓ 1 callersFunction_define_begin_episode
Reset environments, intermediate scores and durations for new episodes. Args: agent_indices: Tensor containing batch indices starting an ep
modelbased-rl/PlaNet/planet/control/simulate.py:130
↓ 1 callersFunction_define_end_episode
Notify the algorithm of ending episodes. Also updates the mean score and length counters used for summaries. Args: agent_indices: Tens
modelbased-rl/PlaNet/planet/control/simulate.py:178
↓ 1 callersMethod_define_parameters
(self)
multiagent-rl/easy-marl/algorithms/DDPG_based/IDDPG.py:27
↓ 1 callersMethod_define_parameters
(self)
multiagent-rl/easy-marl/algorithms/DDPG_based/IDDPG.py:61
↓ 1 callersMethod_define_parameters
(self)
multiagent-rl/easy-marl/algorithms/DDPG_based/MADDPG.py:27
↓ 1 callersMethod_define_parameters
(self)
multiagent-rl/easy-marl/algorithms/DDPG_based/MADDPG.py:61
↓ 1 callersMethod_define_parameters
(self)
multiagent-rl/easy-marl/algorithms/PPO_based/IPPO.py:28
↓ 1 callersMethod_define_parameters
(self)
multiagent-rl/easy-marl/algorithms/PPO_based/MAPPO.py:28
↓ 1 callersMethod_define_parameters
(self)
multiagent-rl/easy-marl/algorithms/PPO_based/MAPPO.py:69
↓ 1 callersMethod_define_parameters
(self)
multiagent-rl/easy-marl/algorithms/DQN_based/CommNet.py:27
↓ 1 callersMethod_define_parameters
(self)
multiagent-rl/easy-marl/algorithms/DQN_based/QMIX.py:67
↓ 1 callersMethod_define_parameters
(self)
multiagent-rl/easy-marl/algorithms/DQN_based/your_new_algorithm.py:27
↓ 1 callersMethod_define_parameters
(self)
multiagent-rl/easy-marl/algorithms/DQN_based/VDN.py:39
↓ 1 callersMethod_define_parameters
(self)
multiagent-rl/easy-marl/algorithms/DQN_based/IDQN.py:27
↓ 1 callersFunction_define_simulation
( task, config, params, horizon, batch_size, objective='reward', rewards=False)
modelbased-rl/PlaNet/planet/scripts/configs.py:286
↓ 1 callersFunction_define_step
Request actions from the algorithm and apply them to the environments. Increments the lengths of all episodes and increases their scores by the
modelbased-rl/PlaNet/planet/control/simulate.py:150
↓ 1 callersMethod_define_step
Combine operations of a phase. Keeps track of the mean score and when to report it. Args: name: Name of the phase used for the score s
modelbased-rl/PlaNet/planet/training/trainer.py:255
↓ 1 callersFunction_define_summaries
Reset the average score and duration, and return them as summary. Returns: Summary string.
modelbased-rl/PlaNet/planet/control/simulate.py:196
↓ 1 callersFunction_deseriealize_params
(params: Dict[str, Any])
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/base.py:102
↓ 1 callersMethod_destroy
(self)
modelbased-rl/SampledMuZero/games/lunarlander.py:325
↓ 1 callersMethod_do_training
Runs the operations for updating training and target ops.
modelbased-rl/BMPO/bmpo.py:704
↓ 1 callersMethod_end_train
(self, holdout_losses)
modelbased-rl/MBPO/ED2-MBPO/mbpo/models/bnn.py:334
↓ 1 callersMethod_end_train
(self, holdout_losses)
modelbased-rl/BMPO/models/bnn.py:278
↓ 1 callersMethod_evaluate
( self, episodes: List[Episode], scorers: Dict[str, Callable[[Any, List[Episode]], flo
offline-rl-algorithms/E2O/d3rlpy_new/d3rlpy/base.py:798
↓ 1 callersMethod_exploration
(self, action, training)
modelbased-rl/Dreamer/ED2-Dreamer/dreamer.py:286
↓ 1 callersMethod_exploration
(self, action, training)
modelbased-rl/Dreamer/Vanilla_Dreamer/dreamer.py:246
↓ 1 callersMethod_find_current_phase
Determine the current phase based on the global step. This ensures continuing the correct phase after restoring checkoints. Args: glob
modelbased-rl/PlaNet/planet/training/trainer.py:236
↓ 1 callersMethod_format
(self, chunks)
modelbased-rl/MBPO/ED2-MBPO/mbpo/utils/logging.py:115
↓ 1 callersMethod_format
(self, chunks)
modelbased-rl/BMPO/utils/logging.py:114
↓ 1 callersMethod_format_chunk
(self, chunk)
modelbased-rl/MBPO/ED2-MBPO/mbpo/utils/logging.py:122
↓ 1 callersMethod_format_chunk
(self, chunk)
modelbased-rl/BMPO/utils/logging.py:121
↓ 1 callersMethod_format_param
(self, param)
modelbased-rl/MBPO/ED2-MBPO/mbpo/utils/logging.py:126
↓ 1 callersMethod_format_param
(self, param)
modelbased-rl/BMPO/utils/logging.py:125
↓ 1 callersMethod_format_percent
(self, n, total)
modelbased-rl/MBPO/ED2-MBPO/mbpo/utils/logging.py:88
↓ 1 callersMethod_format_percent
(self, n, total)
modelbased-rl/BMPO/utils/logging.py:87
↓ 1 callersMethod_format_speed
(self, n)
modelbased-rl/MBPO/ED2-MBPO/mbpo/utils/logging.py:103
↓ 1 callersMethod_format_speed
(self, n)
modelbased-rl/BMPO/utils/logging.py:102
↓ 1 callersMethod_generate_init_pos
Returns randomly selected initial positions for agents and trees in relative coordinates. No agent or trees share the same cell in initial po
multiagent-rl/easy-marl/envs/discrete_magym/envs/lumberjacks/lumberjacks.py:171
↓ 1 callersMethod_generate_run_numbers
Yield run numbers in the order they should be considered. The user of this function must check whether a run is already finished or being wor
modelbased-rl/PlaNet/planet/training/running.py:110
↓ 1 callersMethod_get_Q_target
(self)
modelbased-rl/MBPO/ED2-MBPO/mbpo/algorithms/mbpo.py:505
↓ 1 callersMethod_get_Q_target
(self)
modelbased-rl/BMPO/bmpo.py:549
↓ 1 callersMethod_get_before_action
(self,obs)
modelbased-rl/BMPO/bmpo.py:193
↓ 1 callersMethod_get_done
(self)
multiagent-rl/easy-marl/envs/discrete_meeting.py:101
↓ 1 callersMethod_get_done
(self)
multiagent-rl/easy-marl/envs/continuous_meeting.py:95
↓ 1 callersMethod_get_done
(self, done)
multiagent-rl/easy-marl/envs/discrete_magym/ma_gym_env.py:62
↓ 1 callersMethod_get_done
(self, done)
multiagent-rl/easy-marl/envs/continuous_mpe/mpe_env.py:72
↓ 1 callersMethod_get_done
(self, agent)
multiagent-rl/easy-marl/envs/continuous_mpe/multiagent/environment.py:137
↓ 1 callersMethod_get_episode
(self)
modelbased-rl/PlaNet/planet/control/wrappers.py:503
↓ 1 callersMethod_get_filename
(self)
modelbased-rl/PlaNet/planet/control/wrappers.py:496
↓ 1 callersMethod_get_info
(self)
multiagent-rl/easy-marl/envs/discrete_meeting.py:106
↓ 1 callersMethod_get_info
(self)
multiagent-rl/easy-marl/envs/continuous_meeting.py:100
↓ 1 callersMethod_get_info
(self, info)
multiagent-rl/easy-marl/envs/discrete_magym/ma_gym_env.py:67
↓ 1 callersMethod_get_info
(self, info)
multiagent-rl/easy-marl/envs/continuous_mpe/mpe_env.py:77
↓ 1 callersMethod_get_info
(self, agent)
multiagent-rl/easy-marl/envs/continuous_mpe/multiagent/environment.py:124
↓ 1 callersMethod_get_logprob
(self, x, means, variances)
modelbased-rl/MBPO/ED2-MBPO/mbpo/models/fake_env.py:16
↓ 1 callersMethod_get_logprob
(self, x, means, variances)
modelbased-rl/BMPO/models/fake_env.py:17
↓ 1 callersMethod_get_logprob
(self, x, means, variances)
modelbased-rl/BMPO/models/fake_env.py:127
← previousnext →701–800 of 3,230, ranked by callers