MCPcopy Create free account

hub / github.com/LeapLabTHU/limit-of-RLVR / functions

Functions1,933 in github.com/LeapLabTHU/limit-of-RLVR

↓ 5 callersFunctionsetup
(args)
math/examples/math_eval/math_eval.py:108
↓ 5 callersMethodtransform_assignment
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:1148
↓ 5 callersFunctionunwrap_model
(model, module_instances=ALL_MODULE_WRAPPER_CLASSNAMES)
code/DeepCoder/verl/verl/utils/megatron_utils.py:122
↓ 5 callersFunctionupdate_model_config
(module_config, override_config_kwargs)
code/DeepCoder/verl/verl/utils/model.py:42
↓ 4 callersMethodDIFFERENTIAL
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:4384
↓ 4 callersMethodGREEK_CMD
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:4278
↓ 4 callersMethodOTHER_SYMBOL_CMD
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:4281
↓ 4 callersFunction_broadcast_tensor
broadcast tensor across mp_group
code/DeepCoder/verl/verl/models/llama/megatron/checkpoint_utils/llama_saver.py:131
↓ 4 callersFunction_broadcast_tp_shard_tensor
broadcast tensor in tp shards across mp_group
code/DeepCoder/verl/verl/models/llama/megatron/checkpoint_utils/llama_saver.py:170
↓ 4 callersFunction_get_cpu_tensor
(tensor: torch.Tensor)
code/DeepCoder/verl/verl/models/llama/megatron/checkpoint_utils/llama_saver.py:124
↓ 4 callersFunction_get_gpt_model
(model)
code/DeepCoder/verl/verl/models/llama/megatron/checkpoint_utils/llama_loader.py:63
↓ 4 callersFunction_is_non_local
(path: str)
code/DeepCoder/verl/verl/utils/hdfs_io.py:143
↓ 4 callersFunction_split_args_kwargs_data_proto
(chunks, *args, **kwargs)
code/DeepCoder/verl/verl/single_controller/base/decorator.py:45
↓ 4 callersMethodabs_group
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:3739
↓ 4 callersMethodaccent
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:4171
↓ 4 callersMethodadd
(self, idx: int, val: int)
code/DeepCoder/verl/verl/utils/seqlen_balancing.py:33
↓ 4 callersFunctionallgather_dict_tensors
TODO: optimize this. - We can use async ops - We can use only one allgather Args: tensors: size: group:
code/DeepCoder/verl/verl/utils/torch_functional.py:169
↓ 4 callersMethodargs
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:5828
↓ 4 callersMethodatom_expr_no_supexpr
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:4225
↓ 4 callersMethodbinom
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:4697
↓ 4 callersFunctionbuild_memory_reference_from_module
(module: torch.nn.Module, memory_buffers: Dict[torch.dtype, MemoryBuffe
code/DeepCoder/verl/verl/utils/memory_buffer.py:97
↓ 4 callersMethodceil_group
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:4049
↓ 4 callersFunctioncompute_reward
We compute dense reward here so that we can directly train RL without SFT
code/DeepCoder/verl/tests/e2e/envs/digit_completion/task.py:137
↓ 4 callersFunctionconvert_mp
(mp)
math/examples/math_eval/latex2sympy/latex2sympy2.py:396
↓ 4 callersMethoddump
(self, data: io.BytesIO, name)
code/DeepCoder/verl/verl/utils/debug/trajectory_tracker.py:59
↓ 4 callersMethodeval_at_sub
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:2676
↓ 4 callersMethodeval_at_sup
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:2741
↓ 4 callersMethodexecute_all_async
(self, method_name: str, *args, **kwargs)
code/DeepCoder/verl/verl/single_controller/ray/base.py:335
↓ 4 callersFunctionextract_answer
(pred_str, data_name, use_last_number=True)
math/examples/math_eval/parser.py:499
↓ 4 callersMethodfloor_group
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:3913
↓ 4 callersMethodfrom_single_dict
(cls, data: Dict[str, Union[torch.Tensor, np.ndarray]], meta_info=None)
code/DeepCoder/verl/verl/protocol.py:272
↓ 4 callersMethodfunc_normal_multi_arg
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:5180
↓ 4 callersMethodfunc_normal_single_arg
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:5112
↓ 4 callersFunctionget_fsdp_wrap_policy
(module, config=None)
code/DeepCoder/verl/verl/utils/fsdp_utils.py:48
↓ 4 callersFunctionget_init_weight_context_manager
(use_meta_tensor=True)
code/DeepCoder/verl/verl/utils/fsdp_utils.py:36
↓ 4 callersFunctionget_micro_data_parallel_group
()
code/DeepCoder/verl/verl/workers/sharding_manager/megatron_vllm.py:418
↓ 4 callersMethodget_resource_pool
Get the resource pool of the worker_cls
code/DeepCoder/verl/verl/trainer/ppo/ray_trainer.py:84
↓ 4 callersFunctionget_reverse_idx
(idx_map)
code/DeepCoder/verl/verl/utils/seqlen_balancing.py:259
↓ 4 callersMethodinit_model
(self)
code/DeepCoder/verl/verl/workers/fsdp_workers.py:714
↓ 4 callersFunctioninit_model_parallel_config
(config: DictConfig)
code/DeepCoder/verl/verl/utils/megatron_utils.py:201
↓ 4 callersFunctionload_megatron_model_weights
(config, model_config, parallel_model,
code/DeepCoder/verl/verl/utils/model.py:253
↓ 4 callersMethodmake_iterator
Make an iterator from the DataProto. This is built upon that TensorDict can be used as a normal Pytorch dataset. See https://pytorch.org/tenso
code/DeepCoder/verl/verl/protocol.py:447
↓ 4 callersFunctionmat_mul_flat
(lh, rh)
math/examples/math_eval/latex2sympy/latex2sympy2.py:346
↓ 4 callersMethodmatrix
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:1340
↓ 4 callersMethodnorm_group
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:3635
↓ 4 callersFunctionoffload_fsdp_optimizer
(optimizer)
code/DeepCoder/verl/verl/utils/fsdp_utils.py:113
↓ 4 callersMethodpostfix
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:2442
↓ 4 callersFunctionprint_model_size
(model: nn.Module, name: str = None)
code/DeepCoder/verl/verl/utils/model.py:129
↓ 4 callersFunctionreduce_metrics
(metrics: dict)
code/DeepCoder/verl/verl/trainer/ppo/ray_trainer.py:160
↓ 4 callersFunctionrepeat_kv
This is the equivalent of torch.repeat_interleave(x, dim=1, repeats=n_rep). The hidden states go from (batch, num_key_value_heads, seqlen, he
code/DeepCoder/verl/verl/models/llama/megatron/layers/parallel_attention.py:131
↓ 4 callersFunctionrotate_half
Rotates half the hidden dims of the input.
code/DeepCoder/verl/verl/models/llama/megatron/layers/parallel_attention.py:116
↓ 4 callersMethodsave_checkpoint
(self, step)
code/DeepCoder/verl/verl/trainer/fsdp_sft_trainer.py:295
↓ 4 callersFunctionset_ulysses_sequence_parallel_group
Set ulysses sequence parallel process group.
code/DeepCoder/verl/verl/utils/ulysses.py:29
↓ 4 callersFunctionstrip_string
(string, skip_unit=False)
math/examples/math_eval/parser.py:212
↓ 4 callersMethodsubeq
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:6376
↓ 4 callersFunctionsymbolic_equal
(a, b)
math/examples/math_eval/grader.py:258
↓ 4 callersMethodto_dict
(self)
code/DeepCoder/verl/verl/single_controller/base/worker.py:78
↓ 4 callersMethodtransform_swap
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:1105
↓ 3 callersMethod__init__
(self)
code/DeepCoder/verl/verl/single_controller/ray/base.py:442
↓ 3 callersMethod__init__
(self, dim, max_position_embeddings=2048, base=10000, device=None)
code/DeepCoder/verl/verl/models/llama/megatron/layers/parallel_attention.py:37
↓ 3 callersFunction_broadcast_tp_shard_tensor
broadcast tensor in tp shards across mp_group
code/DeepCoder/verl/verl/models/llama/megatron/checkpoint_utils/llama_loader.py:178
↓ 3 callersMethod_build_param_references
(self, pp_rank, maintain_weight=False)
code/DeepCoder/verl/verl/workers/sharding_manager/megatron_vllm.py:88
↓ 3 callersFunction_concat_data_proto_or_future
(output: List)
code/DeepCoder/verl/verl/single_controller/base/decorator.py:129
↓ 3 callersFunction_get_gpt_model
(model)
code/DeepCoder/verl/verl/models/llama/megatron/checkpoint_utils/llama_saver.py:93
↓ 3 callersFunction_pre_process_inputs
(pad_token_id, prompt_token_ids: torch.Tensor)
code/DeepCoder/verl/verl/workers/rollout/vllm_rollout/vllm_rollout.py:52
↓ 3 callersFunctionadd_flat
(lh, rh)
math/examples/math_eval/latex2sympy/latex2sympy2.py:298
↓ 3 callersFunctionapply_monkey_patch
(config: PretrainedConfig, verbose=True)
code/DeepCoder/verl/verl/models/transformers/monkey_patch.py:42
↓ 3 callersFunctionapply_rotary_pos_emb
(q, k, cos, sin, position_ids)
code/DeepCoder/verl/verl/models/llama/megatron/layers/parallel_attention.py:123
↓ 3 callersMethodatom_expr
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:4304
↓ 3 callersFunctionbuild_memory_buffer
Build the memory buffer given weight_buffer_meta Args: weight_buffer_meta: contains mapping from name to a dictionary containing shape an
code/DeepCoder/verl/verl/utils/memory_buffer.py:68
↓ 3 callersFunctioncalc_padded_numel
for cuda memory alignment, make sure alignment by 128-bits
code/DeepCoder/verl/verl/utils/memory_buffer.py:51
↓ 3 callersFunctioncheck_model_support_rmpad
(model_type: str)
code/DeepCoder/verl/verl/models/registry.py:27
↓ 3 callersMethodcompute_log_prob
Compute logits given a batch of data. Args: data (DataProto): a batch of data represented by DataProto. It must contain key ```in
code/DeepCoder/verl/verl/workers/actor/base.py:39
↓ 3 callersFunctioncompute_transformers_input_shapes
(batches, meta_info)
code/DeepCoder/verl/verl/utils/megatron/pipeline_parallel.py:22
↓ 3 callersFunctionconvert_elementary_transform
(matrix, transform)
math/examples/math_eval/latex2sympy/latex2sympy2.py:205
↓ 3 callersFunctioncreate_device_mesh
(world_size, fsdp_size)
code/DeepCoder/verl/verl/workers/fsdp_workers.py:48
↓ 3 callersMethodelementary_transforms
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:1255
↓ 3 callersMethodeval_at
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:2608
↓ 3 callersMethodexecute_rank_zero_async
(self, method_name: str, *args, **kwargs)
code/DeepCoder/verl/verl/single_controller/ray/base.py:322
↓ 3 callersMethodexp_nofunc
(self, _p=0)
math/examples/math_eval/latex2sympy/gen/PSParser.py:2921
↓ 3 callersMethodfit
The training loop of PPO. The driver process only need to call the compute functions of the worker group through RPC to construct the
code/DeepCoder/verl/verl/trainer/ppo/ray_trainer.py:566
↓ 3 callersMethodfrom_detached
(cls, worker_names=None, ray_cls_with_init=None)
code/DeepCoder/verl/verl/single_controller/ray/base.py:285
↓ 3 callersMethodfunc
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:5348
↓ 3 callersMethodfunc_common_args
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:5889
↓ 3 callersMethodfunc_multi_arg
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:6133
↓ 3 callersMethodfunc_single_arg
(self)
math/examples/math_eval/latex2sympy/gen/PSParser.py:6055
↓ 3 callersMethodgenerate_sequences
Generate sequences
code/DeepCoder/verl/verl/workers/rollout/base.py:35
↓ 3 callersMethodget
(self)
code/DeepCoder/verl/verl/utils/rendezvous/ray_backend.py:30
↓ 3 callersFunctionget_constant_schedule_with_warmup
( optimizer: Optimizer, num_warmup_steps: int, last_epoch: int = -1, )
code/DeepCoder/verl/verl/utils/torch_functional.py:422
↓ 3 callersFunctionget_default_kwargs_for_model_parallel_config
()
code/DeepCoder/verl/verl/utils/megatron/tensor_parallel.py:32
↓ 3 callersFunctionget_megatron_optimizer
( model, config: OptimizerConfig, no_weight_decay_cond=None, scale_lr_cond=Non
code/DeepCoder/verl/verl/utils/megatron/optimizer.py:26
↓ 3 callersFunctionget_parallel_model_from_config
(config, megatron_config, pre_process=None, post_process=None, value=False)
code/DeepCoder/verl/verl/utils/model.py:234
↓ 3 callersFunctionget_sharding_strategy
(device_mesh)
code/DeepCoder/verl/verl/workers/fsdp_workers.py:61
↓ 3 callersFunctionget_simple_examples
Returns an array of tuples, containing the string `input`, sympy `output` using the provided sympy `func`, and `symbolically` boolean for cal
math/examples/math_eval/latex2sympy/tests/context.py:25
↓ 3 callersFunctionhandle_ceil
Apply ceil() then return the ceil-ed expression. expr: Expr - sympy expression as an argument to ceil()
math/examples/math_eval/latex2sympy/latex2sympy2.py:1089
↓ 3 callersFunctionhandle_floor
Apply floor() then return the floored expression. expr: Expr - sympy expression as an argument to floor()
math/examples/math_eval/latex2sympy/latex2sympy2.py:1080
↓ 3 callersFunctionimport_external_libs
(external_libs=None)
code/DeepCoder/verl/verl/utils/import_utils.py:41
↓ 3 callersFunctioninit_megatron_optim_config
(optim_config: Dict)
code/DeepCoder/verl/verl/utils/megatron_utils.py:185
↓ 3 callersMethodinit_workers
Init resource pool and worker group
code/DeepCoder/verl/verl/trainer/ppo/ray_trainer.py:461
↓ 3 callersFunctioninitialize_global_process_group
(timeout_second=36000)
code/DeepCoder/verl/verl/utils/distributed.py:18
← previousnext →101–200 of 1,933, ranked by callers