Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/ZJU-REAL/SkillZero
/ types & classes
Types & classes
522 in github.com/ZJU-REAL/SkillZero
⨍
Functions
3,531
◇
Types & classes
522
↳
Endpoints
90
↓ 33 callers
Class
RayClassWithInitArgs
A wrapper class for Ray actors with initialization arguments. This class extends ClassWithInitArgs to provide additional functionality for co
verl/single_controller/ray/base.py:162
↓ 29 callers
Class
DataProto
A DataProto is a data structure that aims to provide a standard protocol for data exchange between functions. It contains a batch (TensorDict
verl/protocol.py:293
↓ 27 callers
Class
RayWorkerGroup
A group of Ray workers that can be managed collectively. This class extends WorkerGroup to provide Ray-specific functionality for creating an
verl/single_controller/ray/base.py:230
↓ 20 callers
Class
RayResourcePool
verl/single_controller/ray/base.py:85
↓ 13 callers
Class
SGLangRollout
verl/workers/rollout/sglang_rollout/sglang_rollout.py:117
↓ 10 callers
Class
SetWithGet
agent_system/environments/env_package/alfworld/alfworld/gen/utils/py_util.py:43
↓ 9 callers
Class
NoisyLinear
agent_system/environments/env_package/alfworld/alfworld/agents/modules/layers.py:877
↓ 8 callers
Class
FSDPCheckpointManager
Manage FSDP checkpointing in SPMD training. - Saves/loads per-rank sharded model & optimizer states - Persists full lr_scheduler and RNG
verl/utils/checkpoint/fsdp_checkpoint_manager.py:33
↓ 8 callers
Class
FSDPUlyssesShardingManager
Sharding manager to support data resharding when using FSDP + Ulysses
verl/workers/sharding_manager/fsdp_ulysses.py:27
↓ 8 callers
Class
FlopsCounter
Used to count mfu during training loop Example: flops_counter = FlopsCounter(config) flops_achieved, flops_promised = flops_
verl/utils/flops_counter.py:108
↓ 7 callers
Class
ParallelLlamaRMSNorm
verl/models/llama/megatron/layers/parallel_rmsnorm.py:26
↓ 7 callers
Class
ParallelQwen2RMSNorm
verl/models/qwen2/megatron/layers/parallel_rmsnorm.py:26
↓ 7 callers
Class
ResourcePoolManager
Define a resource pool specification. Resource pool will be initialized first.
verl/trainer/ppo/ray_trainer.py:100
↓ 7 callers
Class
SelfAttention
From Multi-Head Attention module https://github.com/jadore801120/attention-is-all-you-need-pytorch
agent_system/environments/env_package/alfworld/alfworld/agents/modules/layers.py:990
↓ 7 callers
Class
Tracking
A unified tracking interface for logging experiment data to multiple backends. This class provides a centralized way to log experiment metrics, p
verl/utils/tracking.py:25
↓ 6 callers
Class
BeamSearchNode
agent_system/environments/env_package/alfworld/alfworld/agents/modules/generic.py:280
↓ 5 callers
Class
FusedLinearForPPO
verl/utils/experimental/torch_functional.py:196
↓ 5 callers
Class
SequenceParallelConfig
tests/models/test_transformers_ulysses.py:42
↓ 5 callers
Class
WebEnv
A wrapper of textEnv for models. Returns valid actions at each step of the game.
agent_system/environments/env_package/webshop/webshop/baseline_models/env.py:17
↓ 4 callers
Class
BiAttention
agent_system/environments/env_package/webshop/webshop/baseline_models/models/modules.py:120
↓ 4 callers
Class
DataParallelPPOActor
verl/workers/actor/dp_actor.py:54
↓ 4 callers
Class
Message
verl/workers/rollout/schemas.py:46
↓ 4 callers
Class
RLHFDataset
Load and preprocess RLHF data from Parquet files. - Caches files locally. - Reads into a HuggingFace Dataset and tokenizes prompts.
verl/utils/dataset/rl_dataset.py:68
↓ 4 callers
Class
SimpleMemory
Memory manager: responsible for storing & fetching per‑environment history records.
agent_system/memory/memory.py:19
↓ 3 callers
Class
AlfWorldEnvironmentManager
agent_system/environments/env_manager.py:301
↓ 3 callers
Class
BertConfigForWebshop
agent_system/environments/env_package/webshop/webshop/baseline_models/models/bert.py:14
↓ 3 callers
Class
BertModelForWebshop
agent_system/environments/env_package/webshop/webshop/baseline_models/models/bert.py:30
↓ 3 callers
Class
DeterministicPlannerAgent
agent_system/environments/env_package/alfworld/alfworld/gen/agents/deterministic_planner_agent.py:4
↓ 3 callers
Class
LinearForLastLayer
verl/models/llama/megatron/layers/parallel_linear.py:82
↓ 3 callers
Class
LinearSchedule
Linear interpolation between initial_p and final_p over schedule_timesteps. After this many timesteps pass final_p is returned. :para
agent_system/environments/env_package/alfworld/alfworld/agents/modules/generic.py:152
↓ 3 callers
Class
Qwen3VLCausalLMOutputForPPO
verl/models/transformers/qwen3_vl.py:229
↓ 3 callers
Class
RayPPOTrainer
Note that this trainer runs on the driver process on a single CPU/GPU node.
verl/trainer/ppo/ray_trainer.py:386
↓ 3 callers
Class
SearchEnvironmentManager
EnvironmentManager for SearchEnv.
agent_system/environments/env_manager.py:72
↓ 3 callers
Class
State
verl/utils/seqlen_balancing.py:46
↓ 3 callers
Class
TaskGameStateFullKnowledge
agent_system/environments/env_package/alfworld/alfworld/gen/game_states/task_game_state_full_knowledge.py:15
↓ 3 callers
Class
ValidationGenerationsLogger
verl/utils/tracking.py:258
↓ 3 callers
Class
vLLMRollout
verl/workers/rollout/vllm_rollout/vllm_rollout.py:67
↓ 2 callers
Class
AppWorldEnvironmentManager
agent_system/environments/env_manager.py:817
↓ 2 callers
Class
AsyncLLMServerManager
AsyncLLMServerManager manage a group of vllm instances, i.e AsyncvLLMServer.
verl/workers/rollout/async_server.py:218
↓ 2 callers
Class
DataParallelSPPOActor
recipe/sppo/dp_actor.py:59
↓ 2 callers
Class
DataProtoFuture
DataProtoFuture aims to eliminate actual data fetching on driver. By doing so, the driver doesn't have to wait for data so that asynchronous
verl/protocol.py:934
↓ 2 callers
Class
Demangler
agent_system/environments/env_package/alfworld/alfworld/agents/utils/misc.py:17
↓ 2 callers
Class
EncoderRNN
agent_system/environments/env_package/webshop/webshop/baseline_models/models/modules.py:31
↓ 2 callers
Class
FSDPSFTTrainer
verl/trainer/fsdp_sft_trainer.py:87
↓ 2 callers
Class
FSDPSGLangShardingManager
verl/workers/sharding_manager/fsdp_sglang.py:49
↓ 2 callers
Class
GymCardEnvironmentManager
agent_system/environments/env_manager.py:640
↓ 2 callers
Class
HFRollout
verl/workers/rollout/hf_rollout.py:39
↓ 2 callers
Class
HumanOutputFormat
agent_system/environments/env_package/webshop/webshop/baseline_models/logger.py:30
↓ 2 callers
Class
LSTMCell
A basic LSTM cell.
agent_system/environments/env_package/alfworld/alfworld/agents/modules/layers.py:470
↓ 2 callers
Class
MegatronCheckpointManager
A checkpoint manager that saves and loads - model - optimizer - lr_scheduler - extra_states in a SPMD way. We save -
verl/utils/checkpoint/megatron_checkpoint_manager.py:39
↓ 2 callers
Class
MegatronPPOActor
verl/workers/actor/megatron_actor.py:58
↓ 2 callers
Class
MemoryBuffer
A memory buffer is a contiguous torch tensor that may combine multiple tensors sharing with the underlying memory. It must have a unique type
verl/utils/memory_buffer.py:24
↓ 2 callers
Class
ModelMergerConfig
scripts/model_merger.py:74
↓ 2 callers
Class
MultiTurnSFTDataset
Dataset for multi-turn conversations where each assistant response should be trained
verl/utils/dataset/multiturn_sft_dataset.py:29
↓ 2 callers
Class
OpenAIFunctionParametersSchema
The schema of parameters in OpenAI format.
verl/tools/schemas.py:29
↓ 2 callers
Class
OpenAIFunctionPropertySchema
The schema of a parameter in OpenAI format.
verl/tools/schemas.py:21
↓ 2 callers
Class
OpenAIFunctionSchema
The schema of a function in OpenAI format.
verl/tools/schemas.py:37
↓ 2 callers
Class
OpenAIFunctionToolSchema
The schema of a tool in OpenAI format.
verl/tools/schemas.py:46
↓ 2 callers
Class
ParallelLlamaDecoderLayerRmPad
verl/models/llama/megatron/layers/parallel_decoder.py:102
↓ 2 callers
Class
ParallelLlamaMLP
verl/models/llama/megatron/layers/parallel_mlp.py:30
↓ 2 callers
Class
ParallelQwen2DecoderLayerRmPad
verl/models/qwen2/megatron/layers/parallel_decoder.py:102
↓ 2 callers
Class
ParallelQwen2MLP
verl/models/qwen2/megatron/layers/parallel_mlp.py:30
↓ 2 callers
Class
Policy
agent_system/environments/env_package/alfworld/alfworld/agents/modules/model.py:13
↓ 2 callers
Class
Qwen2VLCausalLMOutputForPPO
verl/models/transformers/qwen2_vl.py:409
↓ 2 callers
Class
RewardManager
examples/split_placement/main_ppo_split.py:37
↓ 2 callers
Class
SFTDataset
This is an in-memory SFTDataset Arguments: config (OmegaConf): the data config
verl/utils/dataset/sft_dataset.py:33
↓ 2 callers
Class
SmoothedValue
Track a series of values and provide access to smoothed values over a window or the global series average.
agent_system/environments/env_package/alfworld/alfworld/agents/detector/utils.py:15
↓ 2 callers
Class
SokobanEnv
agent_system/environments/env_package/sokoban/sokoban/env.py:10
↓ 2 callers
Class
SokobanEnvironmentManager
agent_system/environments/env_manager.py:543
↓ 2 callers
Class
StackedMatchLSTM
inputs: p: batch x time x inp_p mask_p: batch x time q: batch x time x inp_q mask_q:
agent_system/environments/env_package/alfworld/alfworld/agents/modules/layers.py:596
↓ 2 callers
Class
TestClass
A test class to be imported by load_extern_type
tests/utils/cpu_tests/test_module.py:17
↓ 2 callers
Class
WebshopEnvironmentManager
agent_system/environments/env_manager.py:683
↓ 1 callers
Class
ActivationHandler
verl/utils/activation_offload.py:410
↓ 1 callers
Class
AdaptiveKLController
Adaptive KL controller described in the paper: https://arxiv.org/pdf/1909.08593.pdf
recipe/spin/core_algos.py:22
↓ 1 callers
Class
AdaptiveKLController
Adaptive KL controller described in the paper: https://arxiv.org/pdf/1909.08593.pdf
verl/trainer/ppo/core_algos.py:29
↓ 1 callers
Class
Agent
examples/prompt_agent/gpt4o_alfworld.py:27
↓ 1 callers
Class
Agent
agent_system/environments/env_package/webshop/webshop/baseline_models/agent.py:31
↓ 1 callers
Class
AlfredDemangler
agent_system/environments/env_package/alfworld/alfworld/agents/environment/alfred_tw_env.py:24
↓ 1 callers
Class
AlfredExpert
agent_system/environments/env_package/alfworld/alfworld/agents/environment/alfred_tw_env.py:60
↓ 1 callers
Class
AlfredTWEnv
Interface for Textworld Env
agent_system/environments/env_package/alfworld/alfworld/agents/environment/alfred_tw_env.py:112
↓ 1 callers
Class
AlfredThorEnv
Interface for Embodied (THOR) environment
agent_system/environments/env_package/alfworld/alfworld/agents/environment/alfred_thor_env.py:27
↓ 1 callers
Class
AlfworldEnvs
agent_system/environments/env_package/alfworld/envs.py:85
↓ 1 callers
Class
AppWorldEnvs
A Ray-based distributed wrapper for AppWorld. - Creates multiple Ray actors, each holding a separate AppWorld instance. - Implements Gym-
agent_system/environments/env_package/appworld/envs.py:104
↓ 1 callers
Class
AsyncDoubleBufferGroupOffloadHandler
Compared to synchronize, this uses more memory because of the buffer but achieves better performance due to the overlapping. D2h and h2d copying a
verl/utils/activation_offload.py:214
↓ 1 callers
Class
AsyncRolloutRequest
The data model for async rollout.
verl/workers/rollout/schemas.py:62
↓ 1 callers
Class
BM25Retriever
examples/search/retriever/retrieval_server.py:135
↓ 1 callers
Class
BaseShardingManager
verl/workers/sharding_manager/base.py:21
↓ 1 callers
Class
BlackjackEnv
Blackjack is a card game where the goal is to beat the dealer by obtaining cards that sum to closer to 21 (without going over 21) than the de
agent_system/environments/env_package/gym_cards/gym-cards/gym_cards/envs/blackjack.py:79
↓ 1 callers
Class
BoundaryDecoderAttention
agent_system/environments/env_package/alfworld/alfworld/agents/modules/layers.py:785
↓ 1 callers
Class
BoxFeaturesFC
agent_system/environments/env_package/alfworld/alfworld/agents/modules/layers.py:1604
↓ 1 callers
Class
CQAttention
agent_system/environments/env_package/alfworld/alfworld/agents/modules/layers.py:1216
↓ 1 callers
Class
CSVOutputFormat
agent_system/environments/env_package/webshop/webshop/baseline_models/logger.py:121
↓ 1 callers
Class
Capturing
verl/utils/reward_score/prime_code/testing_util.py:54
↓ 1 callers
Class
CausalLMOutputForPPO
verl/models/transformers/llama.py:236
↓ 1 callers
Class
CharTokenizer
tests/e2e/envs/digit_completion/tokenizer.py:29
↓ 1 callers
Class
ClearMLLogger
verl/utils/tracking.py:146
↓ 1 callers
Class
CocoDetection
agent_system/environments/env_package/alfworld/alfworld/agents/detector/coco_utils.py:208
↓ 1 callers
Class
CocoEvaluator
agent_system/environments/env_package/alfworld/alfworld/agents/detector/coco_eval.py:19
↓ 1 callers
Class
Config
scripts/converter_hf_to_mcore.py:53
↓ 1 callers
Class
Config
tests/utils/gpu_tests/test_flops_counter.py:24
next →
1–100 of 522, ranked by callers