↓ 2 callersMethod__init__(
self,
input_size,
num_heads,
num_key_value_heads,
head_dim,
verl/models/llama/megatron/layers/parallel_linear.py:21
↓ 2 callersMethod_build_model_optimizer(
self,
model_path,
fsdp_config,
optim_config,
override_model_config,
verl/workers/fsdp_workers.py:149
↓ 2 callersFunctioncompute_advantage(data: DataProto, adv_estimator, gamma=1.0, lam=1.0, num_repeat=1, multi_turn=False, norm_adv_by_std_in_grpo=T
verl/trainer/ppo/ray_trainer.py:187