Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/ChenxinAn-fdu/POLARIS
/ types & classes
Types & classes
217 in github.com/ChenxinAn-fdu/POLARIS
⨍
Functions
1,563
◇
Types & classes
217
↳
Endpoints
49
↓ 34 callers
Class
DataProto
A DataProto is a data structure that aims to provide a standard protocol for data exchange between functions. It contains a batch (TensorDict
verl/verl/protocol.py:200
↓ 29 callers
Class
RayClassWithInitArgs
verl/verl/single_controller/ray/base.py:147
↓ 27 callers
Class
RayWorkerGroup
verl/verl/single_controller/ray/base.py:183
↓ 20 callers
Class
RayResourcePool
verl/verl/single_controller/ray/base.py:82
↓ 8 callers
Class
RewardOutput
Data structure for the output of reward calculations. Attributes: reward (float): The computed reward value based on the evaluation of th
deepscaler/rewards/reward_types.py:54
↓ 7 callers
Class
FSDPUlyssesShardingManager
Sharding manager to support data resharding when using FSDP + Ulysses
verl/verl/workers/sharding_manager/fsdp_ulysses.py:27
↓ 7 callers
Class
FlopsCounter
Used to count mfu during training loop Example: flops_counter = FlopsCounter(config) flops_achieved, flops_promised = flops_
verl/verl/utils/flops_counter.py:53
↓ 7 callers
Class
ParallelLlamaRMSNorm
verl/verl/models/llama/megatron/layers/parallel_rmsnorm.py:26
↓ 7 callers
Class
ParallelQwen2RMSNorm
verl/verl/models/qwen2/megatron/layers/parallel_rmsnorm.py:26
↓ 7 callers
Class
ResourcePoolManager
Define a resource pool specification. Resource pool will be initialized first.
verl/verl/trainer/ppo/ray_trainer.py:93
↓ 6 callers
Class
Tracking
verl/verl/utils/tracking.py:25
↓ 5 callers
Class
FSDPCheckpointManager
A checkpoint manager that saves and loads - model - optimizer - lr_scheduler - extra_states in a SPMD way. We save -
verl/verl/utils/checkpoint/fsdp_checkpoint_manager.py:31
↓ 5 callers
Class
SequenceParallelConfig
verl/tests/model/test_transformers_ulysses.py:42
↓ 4 callers
Class
RLHFDataset
We assume the dataset contains a column that contains prompts and other information
verl/verl/utils/dataset/rl_dataset.py:58
↓ 3 callers
Class
RayPPOTrainer
Note that this trainer runs on the driver process on a single CPU/GPU node.
verl/verl/trainer/ppo/ray_trainer.py:288
↓ 3 callers
Class
vLLMRollout
verl/verl/workers/rollout/vllm_rollout/vllm_rollout_spmd.py:77
↓ 2 callers
Class
AsyncLLMServerManager
AsyncLLMServerManager manage a group of vllm instances, i.e AsyncvLLMServer.
verl/verl/workers/rollout/async_server.py:219
↓ 2 callers
Class
AsyncSGLangRollout
verl/verl/workers/rollout/sglang_rollout/async_sglang_rollout.py:74
↓ 2 callers
Class
DataParallelPPOActor
verl/verl/workers/actor/dp_actor.py:47
↓ 2 callers
Class
DataParallelSPPOActor
verl/recipe/sppo/dp_actor.py:59
↓ 2 callers
Class
DataProtoFuture
DataProtoFuture aims to eliminate actual data fetching on driver. By doing so, the driver doesn't have to wait for data so that asynchronous
verl/verl/protocol.py:754
↓ 2 callers
Class
DigitCompletion
The implementation of a simple digit completion task. The prompt is a sequence of numbers with fixed difference. The task is to complete the
verl/tests/e2e/envs/digit_completion/task.py:19
↓ 2 callers
Class
FSDPAsyncSGLangShardingManager
verl/verl/workers/sharding_manager/fsdp_sglang.py:173
↓ 2 callers
Class
FSDPSFTTrainer
verl/verl/trainer/fsdp_sft_trainer.py:84
↓ 2 callers
Class
HFRollout
verl/verl/workers/rollout/hf_rollout.py:38
↓ 2 callers
Class
LinearForLastLayer
verl/verl/models/llama/megatron/layers/parallel_linear.py:82
↓ 2 callers
Class
MegatronCheckpointManager
A checkpoint manager that saves and loads - model - optimizer - lr_scheduler - extra_states in a SPMD way. We save -
verl/verl/utils/checkpoint/megatron_checkpoint_manager.py:37
↓ 2 callers
Class
MegatronPPOActor
verl/verl/workers/actor/megatron_actor.py:55
↓ 2 callers
Class
MemoryBuffer
A memory buffer is a contiguous torch tensor that may combine multiple tensors sharing with the underlying memory. It must have a unique type
verl/verl/utils/memory_buffer.py:24
↓ 2 callers
Class
Message
verl/verl/workers/rollout/schemas.py:46
↓ 2 callers
Class
MultiTurnSFTDataset
Dataset for multi-turn conversations where each assistant response should be trained
verl/verl/utils/dataset/multiturn_sft_dataset.py:29
↓ 2 callers
Class
ParallelLlamaDecoderLayerRmPad
verl/verl/models/llama/megatron/layers/parallel_decoder.py:102
↓ 2 callers
Class
ParallelLlamaMLP
verl/verl/models/llama/megatron/layers/parallel_mlp.py:30
↓ 2 callers
Class
ParallelQwen2DecoderLayerRmPad
verl/verl/models/qwen2/megatron/layers/parallel_decoder.py:102
↓ 2 callers
Class
ParallelQwen2MLP
verl/verl/models/qwen2/megatron/layers/parallel_mlp.py:30
↓ 2 callers
Class
RewardInput
Data structure for input required to calculate rewards. Attributes: problem (str): The original problem text or prompt provided to the mo
deepscaler/rewards/reward_types.py:36
↓ 2 callers
Class
RewardManager
The reward manager.
verl/verl/trainer/main_ppo.py:45
↓ 2 callers
Class
RewardManager
verl/examples/split_placement/main_ppo_split.py:37
↓ 2 callers
Class
RewardMathFn
Reward function for evaluating mathematical answers. This class implements the __call__ method to process the input and determine the re
deepscaler/rewards/math_reward.py:20
↓ 2 callers
Class
SFTDataset
This is an in-memory SFTDataset Arguments: config (OmegaConf): the data config
verl/verl/utils/dataset/sft_dataset.py:33
↓ 2 callers
Class
State
verl/verl/utils/seqlen_balancing.py:47
↓ 2 callers
Class
TestClass
A test class to be imported by load_extern_type
verl/tests/verl/utils/test_module.py:17
↓ 2 callers
Class
ValidationGenerationsLogger
verl/verl/utils/tracking.py:191
↓ 1 callers
Class
AdaptiveKLController
Adaptive KL controller described in the paper: https://arxiv.org/pdf/1909.08593.pdf
verl/verl/trainer/ppo/core_algos.py:29
↓ 1 callers
Class
AsyncRolloutRequest
The data model for async rollout.
verl/verl/workers/rollout/schemas.py:62
↓ 1 callers
Class
BaseShardingManager
verl/verl/workers/sharding_manager/base.py:21
↓ 1 callers
Class
Capturing
verl/verl/utils/reward_score/prime_code/testing_util.py:54
↓ 1 callers
Class
CharTokenizer
verl/tests/e2e/envs/digit_completion/tokenizer.py:29
↓ 1 callers
Class
Config
verl/scripts/converter_hf_to_mcore.py:51
↓ 1 callers
Class
Config
verl/tests/verl/test_flops_counter.py:23
↓ 1 callers
Class
DataParallelPPOCritic
verl/verl/workers/critic/dp_critic.py:44
↓ 1 callers
Class
DataParallelPRIMERewardModel
verl/recipe/prime/prime_dp_rm.py:37
↓ 1 callers
Class
DataProtoItem
verl/verl/protocol.py:192
↓ 1 callers
Class
DistGlobalInfo
verl/verl/single_controller/base/worker.py:36
↓ 1 callers
Class
DistRankInfo
verl/verl/single_controller/base/worker.py:28
↓ 1 callers
Class
FSDPSGLangShardingManager
verl/verl/workers/sharding_manager/fsdp_sglang.py:64
↓ 1 callers
Class
FSDPVLLMShardingManager
verl/verl/workers/sharding_manager/fsdp_vllm.py:39
↓ 1 callers
Class
FixedKLController
Fixed KL controller.
verl/verl/trainer/ppo/core_algos.py:47
↓ 1 callers
Class
HackSelf
verl/tests/ray_gpu/test_driverfunc_to_worker.py:36
↓ 1 callers
Class
LambdaLayer
verl/verl/utils/model.py:36
↓ 1 callers
Class
LlamaDynamicNTKScalingRotaryEmbedding
LlamaRotaryEmbedding extended with Dynamic NTK scaling. Credits to the Reddit users /u/bloc97 and /u/emozilla
verl/verl/models/llama/megatron/layers/parallel_attention.py:91
↓ 1 callers
Class
LlamaLinearScalingRotaryEmbedding
LlamaRotaryEmbedding extended with linear scaling. Credits to the Reddit user /u/kaiokendev
verl/verl/models/llama/megatron/layers/parallel_attention.py:72
↓ 1 callers
Class
LlamaLlama3ScalingRotaryEmbedding
verl/verl/models/llama/megatron/layers/parallel_attention.py:115
↓ 1 callers
Class
LlamaRotaryEmbedding
verl/verl/models/llama/megatron/layers/parallel_attention.py:38
↓ 1 callers
Class
LocalLogger
verl/verl/utils/logger/aggregate_logger.py:32
↓ 1 callers
Class
MegatronPPOCritic
verl/verl/workers/critic/megatron_critic.py:43
↓ 1 callers
Class
MegatronRewardModel
verl/verl/workers/reward_model/megatron/reward_model.py:30
↓ 1 callers
Class
MegatronVLLMShardingManager
verl/verl/workers/sharding_manager/megatron_vllm.py:270
↓ 1 callers
Class
MergedColumnParallelLinear
verl/verl/models/qwen2/megatron/layers/parallel_linear.py:54
↓ 1 callers
Class
MergedColumnParallelLinear
verl/verl/models/llama/megatron/layers/parallel_linear.py:54
↓ 1 callers
Class
ModelConfig
verl/scripts/converter_hf_to_mcore.py:46
↓ 1 callers
Class
NVMegatronRayWorkerGroup
MegatronWorkerGroup will query each worker of its megatron rank info and store it inside the WorkerGroup so that the dispatcher can use it to
verl/verl/single_controller/ray/megatron.py:26
↓ 1 callers
Class
NestedNamespace
verl/verl/utils/py_functional.py:165
↓ 1 callers
Class
OpenAIFunctionParsedSchema
The parsed schema of a tool in OpenAI format.
verl/verl/tools/schemas.py:52
↓ 1 callers
Class
OpenAIFunctionToolCall
The tool call in OpenAI format.
verl/verl/tools/schemas.py:59
↓ 1 callers
Class
ParallelLlamaAttention
Multi-headed attention from 'Attention Is All You Need' paper
verl/verl/models/llama/megatron/layers/parallel_attention.py:169
↓ 1 callers
Class
ParallelLlamaAttentionRmPad
verl/verl/models/llama/megatron/layers/parallel_attention.py:350
↓ 1 callers
Class
ParallelLlamaDecoderLayer
verl/verl/models/llama/megatron/layers/parallel_decoder.py:35
↓ 1 callers
Class
ParallelLlamaForCausalLMRmPadPP
verl/verl/models/llama/megatron/modeling_llama_megatron.py:515
↓ 1 callers
Class
ParallelLlamaModel
Transformer decoder consisting of *config.num_hidden_layers* layers. Each layer is a [`LlamaDecoderLayer`] Args: config: LlamaConfig
verl/verl/models/llama/megatron/modeling_llama_megatron.py:74
↓ 1 callers
Class
ParallelLlamaModelRmPad
Transformer decoder consisting of *config.num_hidden_layers* layers. Each layer is a [`LlamaDecoderLayer`] Args: config: LlamaConfig
verl/verl/models/llama/megatron/modeling_llama_megatron.py:215
↓ 1 callers
Class
ParallelLlamaModelRmPadPP
Transformer decoder consisting of *config.num_hidden_layers* layers. Each layer is a [`LlamaDecoderLayer`] This model definition supports pip
verl/verl/models/llama/megatron/modeling_llama_megatron.py:402
↓ 1 callers
Class
ParallelQwen2Attention
Multi-headed attention from 'Attention Is All You Need' paper
verl/verl/models/qwen2/megatron/layers/parallel_attention.py:146
↓ 1 callers
Class
ParallelQwen2AttentionRmPad
verl/verl/models/qwen2/megatron/layers/parallel_attention.py:296
↓ 1 callers
Class
ParallelQwen2DecoderLayer
verl/verl/models/qwen2/megatron/layers/parallel_decoder.py:35
↓ 1 callers
Class
ParallelQwen2Model
Transformer decoder consisting of *config.num_hidden_layers* layers. Each layer is a [`Qwen2DecoderLayer`] Args: config: Qwen2Config
verl/verl/models/qwen2/megatron/modeling_qwen2_megatron.py:74
↓ 1 callers
Class
ParallelQwen2ModelRmPad
Transformer decoder consisting of *config.num_hidden_layers* layers. Each layer is a [`Qwen2DecoderLayer`] Args: config: Qwen2Config
verl/verl/models/qwen2/megatron/modeling_qwen2_megatron.py:215
↓ 1 callers
Class
ParallelQwen2ModelRmPadPP
Transformer decoder consisting of *config.num_hidden_layers* layers. Each layer is a [`Qwen2DecoderLayer`] This model definition supports pip
verl/verl/models/qwen2/megatron/modeling_qwen2_megatron.py:402
↓ 1 callers
Class
Profiler
verl/verl/utils/debug/profile.py:21
↓ 1 callers
Class
QKVParallelLinear
verl/verl/models/qwen2/megatron/layers/parallel_linear.py:20
↓ 1 callers
Class
QKVParallelLinear
verl/verl/models/llama/megatron/layers/parallel_linear.py:20
↓ 1 callers
Class
Qwen2RotaryEmbedding
verl/verl/models/qwen2/megatron/layers/parallel_attention.py:42
↓ 1 callers
Class
RMDataset
verl/verl/utils/dataset/rm_dataset.py:39
↓ 1 callers
Class
RayDAPOTrainer
Note that this trainer runs on the driver process on a single CPU/GPU node.
verl/recipe/dapo/src/dapo_ray_trainer.py:38
↓ 1 callers
Class
RayPRIMETrainer
Note that this trainer runs on the driver process on a single CPU/GPU node.
verl/recipe/prime/prime_ray_trainer.py:137
↓ 1 callers
Class
RaySPPOTrainer
Note that this trainer runs on the driver process on a single CPU/GPU node.
verl/recipe/sppo/sppo_ray_trainer.py:68
↓ 1 callers
Class
RewardConfig
deepscaler/rewards/reward_types.py:10
↓ 1 callers
Class
SGLangRollout
verl/verl/workers/rollout/sglang_rollout/sglang_rollout.py:94
↓ 1 callers
Class
Set
verl/verl/utils/seqlen_balancing.py:26
↓ 1 callers
Class
SupportedModel
verl/verl/models/mcore/registry.py:52
next →
1–100 of 217, ranked by callers