Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/LeapLabTHU/limit-of-RLVR
/ types & classes
Types & classes
193 in github.com/LeapLabTHU/limit-of-RLVR
⨍
Functions
1,933
◇
Types & classes
193
↳
Endpoints
42
↓ 22 callers
Class
DataProto
A DataProto is a data structure that aims to provide a standard protocol for data exchange between functions. It contains a batch (TensorDict
code/DeepCoder/verl/verl/protocol.py:171
↓ 18 callers
Class
RayClassWithInitArgs
code/DeepCoder/verl/verl/single_controller/ray/base.py:128
↓ 18 callers
Class
RayWorkerGroup
code/DeepCoder/verl/verl/single_controller/ray/base.py:176
↓ 14 callers
Class
RayResourcePool
code/DeepCoder/verl/verl/single_controller/ray/base.py:49
↓ 7 callers
Class
ParallelLlamaRMSNorm
code/DeepCoder/verl/verl/models/llama/megatron/layers/parallel_rmsnorm.py:25
↓ 5 callers
Class
FSDPUlyssesShardingManager
Sharding manager to support data resharding when using FSDP + Ulysses
code/DeepCoder/verl/verl/workers/sharding_manager/fsdp_ulysses.py:33
↓ 4 callers
Class
SFTDataset
This is an in-memory SFTDataset
code/DeepCoder/verl/verl/utils/dataset/sft_dataset.py:34
↓ 3 callers
Class
PythonExecutor
math/examples/math_eval/python_executor.py:64
↓ 3 callers
Class
RLHFDataset
We assume the dataset contains a column that contains prompts and other information
code/DeepCoder/verl/verl/utils/dataset/rl_dataset.py:58
↓ 3 callers
Class
RayPPOTrainer
Note that this trainer runs on the driver process on a single CPU/GPU node.
code/DeepCoder/verl/verl/trainer/ppo/ray_trainer.py:301
↓ 3 callers
Class
ResourcePoolManager
Define a resource pool specification. Resource pool will be initialized first. Mapping
code/DeepCoder/verl/verl/trainer/ppo/ray_trainer.py:64
↓ 3 callers
Class
Tracking
code/DeepCoder/verl/verl/utils/tracking.py:24
↓ 2 callers
Class
DataParallelPPOActor
code/DeepCoder/verl/verl/workers/actor/dp_actor.py:39
↓ 2 callers
Class
DataProtoFuture
DataProtoFuture aims to eliminate actual data fetching on driver. By doing so, the driver doesn't have to wait for data so that asynchronous
code/DeepCoder/verl/verl/protocol.py:602
↓ 2 callers
Class
DigitCompletion
The implementation of a simple digit completion task. The prompt is a sequence of numbers with fixed difference. The task is to complete the
code/DeepCoder/verl/tests/e2e/envs/digit_completion/task.py:19
↓ 2 callers
Class
FlopsCounter
Used to count mfu during training loop Example: flops_counter = FlopsCounter(config) flops_achieved, flops_promised = flops_
code/DeepCoder/verl/verl/utils/flops_counter.py:51
↓ 2 callers
Class
MegatronPPOActor
code/DeepCoder/verl/verl/workers/actor/megatron_actor.py:48
↓ 2 callers
Class
ParallelLlamaDecoderLayerRmPad
code/DeepCoder/verl/verl/models/llama/megatron/layers/parallel_decoder.py:99
↓ 2 callers
Class
ParallelLlamaMLP
code/DeepCoder/verl/verl/models/llama/megatron/layers/parallel_mlp.py:31
↓ 2 callers
Class
RewardManager
The reward manager.
code/DeepCoder/verl/verl/trainer/main_ppo.py:35
↓ 2 callers
Class
RewardManager
code/DeepCoder/verl/examples/split_placement/main_ppo_split.py:33
↓ 2 callers
Class
State
code/DeepCoder/verl/verl/utils/seqlen_balancing.py:49
↓ 2 callers
Class
vLLMRollout
code/DeepCoder/verl/verl/workers/rollout/vllm_rollout/vllm_rollout.py:60
↓ 1 callers
Class
AdaptiveKLController
Adaptive KL controller described in the paper: https://arxiv.org/pdf/1909.08593.pdf
code/DeepCoder/verl/verl/trainer/ppo/core_algos.py:28
↓ 1 callers
Class
AllGatherPPModel
code/DeepCoder/verl/verl/workers/sharding_manager/megatron_vllm.py:35
↓ 1 callers
Class
BaseShardingManager
code/DeepCoder/verl/verl/workers/sharding_manager/base.py:21
↓ 1 callers
Class
CharTokenizer
code/DeepCoder/verl/tests/e2e/envs/digit_completion/tokenizer.py:29
↓ 1 callers
Class
ChatDataCollator
code/DeepCoder/scripts/sft/chat_completions_sft.py:87
↓ 1 callers
Class
DataParallelPPOCritic
code/DeepCoder/verl/verl/workers/critic/dp_critic.py:39
↓ 1 callers
Class
DataProtoItem
code/DeepCoder/verl/verl/protocol.py:163
↓ 1 callers
Class
DistGlobalInfo
code/DeepCoder/verl/verl/single_controller/base/worker.py:31
↓ 1 callers
Class
DistRankInfo
code/DeepCoder/verl/verl/single_controller/base/worker.py:24
↓ 1 callers
Class
FSDPSFTTrainer
code/DeepCoder/verl/verl/trainer/fsdp_sft_trainer.py:58
↓ 1 callers
Class
FSDPVLLMShardingManager
code/DeepCoder/verl/verl/workers/sharding_manager/fsdp_vllm.py:48
↓ 1 callers
Class
FakeTimers
Disable All Megatron Timing with FakeTimers
code/DeepCoder/verl/verl/utils/megatron_utils.py:215
↓ 1 callers
Class
FixedKLController
Fixed KL controller.
code/DeepCoder/verl/verl/trainer/ppo/core_algos.py:46
↓ 1 callers
Class
GenericRuntime
math/examples/math_eval/python_executor.py:20
↓ 1 callers
Class
HFRollout
code/DeepCoder/verl/verl/workers/rollout/hf_rollout.py:35
↓ 1 callers
Class
HackSelf
code/DeepCoder/verl/tests/ray/test_driverfunc_to_worker.py:36
↓ 1 callers
Class
KeywordsStoppingCriteria
math/examples/math_eval/model_utils.py:6
↓ 1 callers
Class
LambdaLayer
code/DeepCoder/verl/verl/utils/model.py:28
↓ 1 callers
Class
LlamaDynamicNTKScalingRotaryEmbedding
LlamaRotaryEmbedding extended with Dynamic NTK scaling. Credits to the Reddit users /u/bloc97 and /u/emozilla
code/DeepCoder/verl/verl/models/llama/megatron/layers/parallel_attention.py:91
↓ 1 callers
Class
LlamaLinearScalingRotaryEmbedding
LlamaRotaryEmbedding extended with linear scaling. Credits to the Reddit user /u/kaiokendev
code/DeepCoder/verl/verl/models/llama/megatron/layers/parallel_attention.py:72
↓ 1 callers
Class
LlamaRotaryEmbedding
code/DeepCoder/verl/verl/models/llama/megatron/layers/parallel_attention.py:35
↓ 1 callers
Class
LocalLogger
code/DeepCoder/verl/verl/utils/logger/aggregate_logger.py:30
↓ 1 callers
Class
MathErrorListener
math/examples/math_eval/latex2sympy/latex2sympy2.py:117
↓ 1 callers
Class
MegatronPPOCritic
code/DeepCoder/verl/verl/workers/critic/megatron_critic.py:41
↓ 1 callers
Class
MegatronRewardModel
code/DeepCoder/verl/verl/workers/reward_model/megatron/reward_model.py:37
↓ 1 callers
Class
MegatronVLLMShardingManager
code/DeepCoder/verl/verl/workers/sharding_manager/megatron_vllm.py:238
↓ 1 callers
Class
MemoryBuffer
A memory buffer is a contiguous torch tensor that may combine multiple tensors sharing with the underlying memory. It must have a unique type
code/DeepCoder/verl/verl/utils/memory_buffer.py:24
↓ 1 callers
Class
MemoryBufferModuleWrapper
Note that we do not design MemoryBufferModuleWrapper as an nn.Module due to - It will change the checkpoint name
code/DeepCoder/verl/verl/utils/memory_buffer.py:140
↓ 1 callers
Class
MergedColumnParallelLinear
code/DeepCoder/verl/verl/models/llama/megatron/layers/parallel_linear.py:52
↓ 1 callers
Class
NVMegatronRayWorkerGroup
MegatronWorkerGroup will query each worker of its megatron rank info and store it inside the WorkerGroup so that the dispatcher can use it to
code/DeepCoder/verl/verl/single_controller/ray/megatron.py:25
↓ 1 callers
Class
NestedNamespace
code/DeepCoder/verl/verl/utils/py_functional.py:48
↓ 1 callers
Class
OptimizerConfig
Configuration for optimizer.
code/DeepCoder/verl/verl/utils/megatron/optimizer_config.py:23
↓ 1 callers
Class
PSLexer
math/examples/math_eval/latex2sympy/gen/PSLexer.py:1114
↓ 1 callers
Class
PSParser
math/examples/math_eval/latex2sympy/gen/PSParser.py:415
↓ 1 callers
Class
ParallelLlamaAttention
Multi-headed attention from 'Attention Is All You Need' paper
code/DeepCoder/verl/verl/models/llama/megatron/layers/parallel_attention.py:143
↓ 1 callers
Class
ParallelLlamaAttentionRmPad
code/DeepCoder/verl/verl/models/llama/megatron/layers/parallel_attention.py:338
↓ 1 callers
Class
ParallelLlamaDecoderLayer
code/DeepCoder/verl/verl/models/llama/megatron/layers/parallel_decoder.py:33
↓ 1 callers
Class
ParallelLlamaForCausalLMRmPadPP
code/DeepCoder/verl/verl/models/llama/megatron/modeling_llama_megatron.py:514
↓ 1 callers
Class
ParallelLlamaModel
Transformer decoder consisting of *config.num_hidden_layers* layers. Each layer is a [`LlamaDecoderLayer`] Args: config: LlamaConfig
code/DeepCoder/verl/verl/models/llama/megatron/modeling_llama_megatron.py:72
↓ 1 callers
Class
ParallelLlamaModelRmPad
Transformer decoder consisting of *config.num_hidden_layers* layers. Each layer is a [`LlamaDecoderLayer`] Args: config: LlamaConfig
code/DeepCoder/verl/verl/models/llama/megatron/modeling_llama_megatron.py:215
↓ 1 callers
Class
ParallelLlamaModelRmPadPP
Transformer decoder consisting of *config.num_hidden_layers* layers. Each layer is a [`LlamaDecoderLayer`] This model definition supports pip
code/DeepCoder/verl/verl/models/llama/megatron/modeling_llama_megatron.py:400
↓ 1 callers
Class
QKVParallelLinear
code/DeepCoder/verl/verl/models/llama/megatron/layers/parallel_linear.py:21
↓ 1 callers
Class
RMDataset
code/DeepCoder/verl/verl/utils/dataset/rm_dataset.py:40
↓ 1 callers
Class
Set
code/DeepCoder/verl/verl/utils/seqlen_balancing.py:27
↓ 1 callers
Class
Trainer
code/DeepCoder/verl/tests/ray/detached_worker/server.py:49
↓ 1 callers
Class
WorkerMeta
code/DeepCoder/verl/verl/single_controller/base/worker.py:70
↓ 1 callers
Class
_MlflowLoggingAdapter
code/DeepCoder/verl/verl/utils/tracking.py:61
Class
Abs_groupContext
math/examples/math_eval/latex2sympy/gen/PSParser.py:3689
Class
AccentContext
math/examples/math_eval/latex2sympy/gen/PSParser.py:4141
Class
Accent_symbolContext
math/examples/math_eval/latex2sympy/gen/PSParser.py:808
Class
Actor
code/DeepCoder/verl/tests/ray/test_colocated_workers.py:25
Class
ActorRolloutRefWorker
This worker can be instantiated as a standalone actor or a standalone rollout or a standalone reference policy or a hybrid engine based on th
code/DeepCoder/verl/verl/workers/megatron_workers.py:63
Class
ActorRolloutRefWorker
This worker can be instantiated as a standalone actor or a standalone rollout or a standalone reference policy or a hybrid engine based on th
code/DeepCoder/verl/verl/workers/fsdp_workers.py:72
Class
AdditiveContext
math/examples/math_eval/latex2sympy/gen/PSParser.py:1982
Class
ArgsContext
math/examples/math_eval/latex2sympy/gen/PSParser.py:5802
Class
AsciiMathPrinter
math/examples/math_eval/latex2sympy/asciimath_printer.py:4
Class
AtomContext
math/examples/math_eval/latex2sympy/gen/PSParser.py:4363
Class
Atom_exprContext
math/examples/math_eval/latex2sympy/gen/PSParser.py:4269
Class
Atom_expr_no_supexprContext
math/examples/math_eval/latex2sympy/gen/PSParser.py:4193
Class
BasePPOActor
code/DeepCoder/verl/verl/workers/actor/base.py:26
Class
BasePPOCritic
code/DeepCoder/verl/verl/workers/critic/base.py:26
Class
BasePPORewardModel
code/DeepCoder/verl/verl/workers/reward_model/base.py:23
Class
BaseRollout
code/DeepCoder/verl/verl/workers/rollout/base.py:23
Class
BinomContext
math/examples/math_eval/latex2sympy/gen/PSParser.py:4654
Class
Ceil_groupContext
math/examples/math_eval/latex2sympy/gen/PSParser.py:4005
Class
ClassWithInitArgs
This class stores a class constructor and the args/kwargs to construct the class. It is used to instantiate the remote class.
code/DeepCoder/verl/verl/single_controller/base/worker_group.py:60
Class
ColorObjectRuntime
math/examples/math_eval/python_executor.py:60
Class
CompContext
math/examples/math_eval/latex2sympy/gen/PSParser.py:2986
Class
Comp_nofuncContext
math/examples/math_eval/latex2sympy/gen/PSParser.py:3118
Class
Critic
code/DeepCoder/verl/tests/ray/test_colocated_workers.py:37
Class
CriticWorker
code/DeepCoder/verl/verl/workers/megatron_workers.py:408
Class
CriticWorker
code/DeepCoder/verl/verl/workers/fsdp_workers.py:559
Class
CustomDict
math/examples/math_eval/python_executor.py:56
Class
DateRuntime
math/examples/math_eval/python_executor.py:48
Class
DetContext
math/examples/math_eval/latex2sympy/gen/PSParser.py:1405
Class
Dispatch
code/DeepCoder/verl/verl/single_controller/base/decorator.py:25
Class
DummyWorker
code/DeepCoder/verl/tests/ray/test_data_transfer.py:37
next →
1–100 of 193, ranked by callers