↓ 3 callersMethod_init_hf_config_and_tf_config(
self,
model_path,
tokenizer_or_path,
dtype,
override_model_config,
verl/verl/workers/megatron_workers.py:104
↓ 3 callersFunctioncompute_detach_dpo_loss_rm(token_level_scores, acc, Q_bc, acc_bc, response_mask, beta, bon_mode="none")
verl/recipe/prime/prime_core_algos.py:88
↓ 3 callersMethodcreate_tool_class(self, register_name, register_client_id, tool_name, tool_desc, tool_parameters)
demo/qwen_agent/tools/mcp_manager.py:264
↓ 3 callersFunctionget_response_mask end of sentence token can be int or list: 1 or [1, 2] e.g. response_id = torch.tensor([[20, 10, 34, 1, 0, 0, 0],
verl/verl/utils/torch_functional.py:226