↓ 1 callersFunctionget_optimizer_grouped_parameters(
model,
weight_decay,
no_decay_name_list=["bias", "layer_norm.weight", "layernorm.weight", "norm.
train/OpenRLHF/openrlhf/utils/deepspeed_utils.py:85
↓ 1 callersFunctionget_train_ds_config(
offload,
adam_offload=True,
stage=2,
bf16=True,
max_norm=1.0,
zpg=8,
grad_accum_
train/OpenRLHF/openrlhf/utils/deepspeed_utils.py:13
↓ 1 callersFunctionreset_ring_attn_position_ids Calculate position ids for packed_seq_ids[start:end]. For example, if the packed_seq_lens is [3, 2, 4, 1], start=2, end=8, the position i
train/OpenRLHF/openrlhf/models/ring_attn_utils.py:18
↓ 1 callersMethodsave_logs_and_checkpoints(self, args, global_step, step_bar, logs_dict={}, client_states={})
train/OpenRLHF/openrlhf/trainer/prm_trainer.py:175
↓ 1 callersMethodsave_logs_and_checkpoints(self, args, global_step, step_bar, logs_dict={}, client_states={})
train/OpenRLHF/openrlhf/trainer/kto_trainer.py:186
↓ 1 callersMethodsave_logs_and_checkpoints(self, args, global_step, step_bar, logs_dict={}, client_states={})
train/OpenRLHF/openrlhf/trainer/rm_trainer.py:210
↓ 1 callersMethodsave_logs_and_checkpoints(self, args, global_step, step_bar, logs_dict={}, client_states={})
train/OpenRLHF/openrlhf/trainer/dpo_trainer.py:218
↓ 1 callersMethodsave_logs_and_checkpoints(self, args, global_step, step_bar, logs_dict={}, client_states={})
train/OpenRLHF/openrlhf/trainer/ppo_trainer.py:472
↓ 1 callersMethodsave_logs_and_checkpoints(self, args, global_step, step_bar, logs_dict={}, client_states={})
train/OpenRLHF/openrlhf/trainer/sft_trainer.py:199
↓ 1 callersMethodsave_logs_and_checkpoints(self, args, global_step, step_bar, logs_dict={}, client_states={})
train/OpenRLHF/openrlhf/trainer/kd_trainer.py:187
Method__init__(
self,
model,
strategy,
optim: Optimizer,
train_dataloader,
e
train/OpenRLHF/openrlhf/trainer/prm_trainer.py:30
Method__init__(
self,
model,
ref_model,
strategy,
tokenizer,
optim: Optimize
train/OpenRLHF/openrlhf/trainer/kto_trainer.py:31
Method__init__(
self,
model,
strategy,
optim: Optimizer,
train_dataloader,
e
train/OpenRLHF/openrlhf/trainer/rm_trainer.py:33
Method__init__(
self,
model,
ref_model,
strategy,
tokenizer,
optim: Optimize
train/OpenRLHF/openrlhf/trainer/dpo_trainer.py:36
Method__init__(
self,
model,
strategy,
optim: Optimizer,
train_dataloader,
e
train/OpenRLHF/openrlhf/trainer/sft_trainer.py:34
Method__init__(
self,
model,
teacher_model,
strategy,
optim: Optimizer,
trai
train/OpenRLHF/openrlhf/trainer/kd_trainer.py:34
Method__init__(self, world_size, rank, local_rank, master_addr, master_port)
train/OpenRLHF/openrlhf/trainer/ray/launcher.py:16
Method__init__(
self,
dataset,
tokenizer: Callable,
max_length: int,
strategy,
train/OpenRLHF/openrlhf/datasets/sft_dataset.py:37
Method__init__(
self,
dataset,
tokenizer: Callable,
max_length: int,
strategy,
train/OpenRLHF/openrlhf/datasets/process_reward_dataset.py:23
Method__init__(
self,
dataset,
tokenizer,
strategy,
input_template=None,
)
train/OpenRLHF/openrlhf/datasets/prompts_dataset.py:29
Method__init__(
self, dataset, tokenizer: Callable, max_length: int, strategy, input_template=None, num_processors=8
train/OpenRLHF/openrlhf/datasets/unpaired_preference_dataset.py:47
Method__init__(
self,
dataset,
tokenizer: Callable,
max_length: int,
strategy,
train/OpenRLHF/openrlhf/datasets/reward_dataset.py:60