↓ 13 callersFunctionblending_datasets(
datasets,
probabilities,
strategy=None,
seed=42,
max_count=5000000,
return_eval=True
train/OpenRLHF/openrlhf/utils/utils.py:44
↓ 10 callersMethodload_ckpt(
self,
model,
load_dir,
tag=None,
load_module_strict=True,
lo
train/OpenRLHF/openrlhf/utils/deepspeed.py:443
↓ 10 callersMethodsave_ckpt(self, model, save_dir, tag=None, max_num=3, max_mem=1000, client_state={}, save_latest=True)
train/OpenRLHF/openrlhf/utils/deepspeed.py:410
↓ 4 callersMethodpacked_samples_forward(self, model, packed_input_ids, packed_attention_masks, packed_seq_lens, prompt_id_lens)
train/OpenRLHF/openrlhf/trainer/dpo_trainer.py:392
↓ 1 callersMethodcompute_model_logps(self, model, input_ids, attention_mask, labels, prompt_id_lens)
train/OpenRLHF/openrlhf/trainer/kto_trainer.py:289
↓ 1 callersFunctioncompute_reward(
r: Union[torch.Tensor, float],
kl_coef: float,
kl: Union[torch.Tensor, List[torch.Tensor]],
train/OpenRLHF/openrlhf/models/utils.py:39