MCPcopy Create free account

hub / github.com/DLYuanGod/MegaTrain / functions

Functions5,181 in github.com/DLYuanGod/MegaTrain

↓ 2 callersFunction_load_hf_model
Helper function containing the loading hf model logic
verl/verl/utils/model.py:413
↓ 2 callersMethod_log_generations_to_wandb
Log samples to wandb as a table
verl/verl/utils/tracking.py:414
↓ 2 callersMethod_log_rollout_data
Log rollout data to disk. Args: batch (DataProto): The batch containing rollout data reward_extra_infos_dict (dict): A
verl/verl/trainer/ppo/ray_trainer.py:437
↓ 2 callersMethod_make_adapter
Build a minimal ServerAdapter-like object without real init.
verl/tests/workers/rollout/rollout_sglang/test_lora_sleep_level.py:114
↓ 2 callersFunction_make_group_index
Create a numpy index array ensuring each group has at least 2 samples.
verl/tests/trainer/ppo/test_core_algos_on_cpu.py:200
↓ 2 callersFunction_marlin_process_scales_experts
Process scales for each expert into Marlin format and stack.
verl/verl/utils/qat/vllm_patch.py:474
↓ 2 callersFunction_marlin_process_scales_experts
(scale_hf, param_dtype, size_k, size_n, group_size, num_experts)
verl/verl/utils/modelopt/vllm_modelopt_patch.py:305
↓ 2 callersFunction_marlin_repack_experts
Repack weight for each expert into Marlin format and stack.
verl/verl/utils/qat/vllm_patch.py:454
↓ 2 callersFunction_marlin_repack_experts
(packed, perm, size_k, size_n, num_experts)
verl/verl/utils/modelopt/vllm_modelopt_patch.py:287
↓ 2 callersFunction_materialize_futures
(*args, **kwargs)
verl/verl/single_controller/base/decorator.py:383
↓ 2 callersMethod_merge_vision_embeddings
Merge image embeddings into text hidden states at image token positions.
infinity/model/cpu_master.py:1054
↓ 2 callersFunction_meta_to_realdata
(meta: BatchMeta)
verl/verl/utils/transferqueue_utils.py:129
↓ 2 callersMethod_move_to_device
Move layer parameters to device.
infinity/memory/layer_manager.py:66
↓ 2 callersFunction_normalize
Normalize answer expressions.
verl/verl/utils/reward_score/prime_math/__init__.py:126
↓ 2 callersFunction_normalize
(x: torch.Tensor, min_val: float, max_val: float)
verl/verl/experimental/vla/models/pi0_torch/pi0_utils.py:319
↓ 2 callersFunction_one_call
(dev_kw=None)
verl/verl/utils/memory_utils.py:185
↓ 2 callersFunction_pad_teacher_outputs
( teacher_ids: torch.Tensor, teacher_logprobs: torch.Tensor, prompt_width: int, response_width
verl/verl/experimental/teacher_loop/teacher_manager.py:47
↓ 2 callersFunction_pad_tensor
(x: Tensor, dim: int, padding_size: int)
verl/verl/utils/ulysses.py:104
↓ 2 callersMethod_pad_to_dim
Pad an array to the target dimension with zeros along the specified axis.
verl/verl/experimental/vla/models/pi0_torch/pi0_utils.py:300
↓ 2 callersMethod_pad_to_length
(self, input_ids, attention_mask)
verl/verl/utils/dataset/rm_dataset.py:120
↓ 2 callersFunction_padding_and_split_data
(obj, chunks)
verl/verl/single_controller/base/decorator.py:97
↓ 2 callersFunction_parse
(s)
verl/verl/utils/reward_score/prime_math/grader.py:325
↓ 2 callersFunction_postprocess_common
Common post-processing logic for function outputs in TransferQueue bridge. This function handles the final return value based on whether data sho
verl/verl/utils/transferqueue_utils.py:211
↓ 2 callersMethod_postprocess_output
Args: output: a dictionary containing loss, model_outputs and metrics Returns:
verl/verl/workers/engine_workers.py:177
↓ 2 callersMethod_prefetch_one
Issue prefetch for next layer.
infinity/scheduler/admission_control.py:93
↓ 2 callersMethod_prepare_4d_causal_mask
Convert 2D padding mask [B, T] to 4D causal attention mask [B, 1, T, T].
infinity/model/cpu_master.py:980
↓ 2 callersMethod_prepare_input_for_action_prediction
Prepares input for action prediction by adding necessary tokens
verl/verl/experimental/vla/models/openvla_oft/modeling_prismatic.py:1351
↓ 2 callersMethod_prepare_labels_for_action_prediction
Creates labels tensor for action prediction if not provided
verl/verl/experimental/vla/models/openvla_oft/modeling_prismatic.py:1374
↓ 2 callersMethod_process_action_masks
Helper to get action masks from labels
verl/verl/experimental/vla/models/openvla_oft/modeling_prismatic.py:447
↓ 2 callersMethod_process_layer_group
Quantize one decoder layer's buffered params. Returns list of (name, tensor).
verl/verl/utils/qat/quantizer.py:177
↓ 2 callersMethod_process_vision
Process images through vision encoder + projector on GPU, then offload.
infinity/model/cpu_master.py:1004
↓ 2 callersMethod_process_vision_features
Process vision features with optional FiLM conditioning
verl/verl/experimental/vla/models/openvla_oft/modeling_prismatic.py:454
↓ 2 callersFunction_qwen3_sparse_moe_routed_forward_npu
Shared NPU routed-expert path for Qwen3Moe/Qwen3Next sparse MoE blocks. Returns: tuple: (flattened_input, routed_hidden_states,
verl/verl/models/transformers/npu_patch.py:139
↓ 2 callersFunction_rand_mask
(batch_size: int, seq_len: int)
verl/tests/trainer/ppo/test_core_algos_on_cpu.py:214
↓ 2 callersFunction_read_async_response
(resp: aiohttp.ClientResponse)
verl/verl/workers/rollout/trtllm_rollout/trtllm_rollout.py:108
↓ 2 callersMethod_read_files_and_tokenize
(self)
verl/verl/utils/dataset/rl_dataset.py:154
↓ 2 callersFunction_read_response
(response: requests.Response)
verl/verl/workers/rollout/sglang_rollout/http_server_engine.py:75
↓ 2 callersFunction_record_directory_structure
(folder_path)
verl/verl/utils/fs.py:164
↓ 2 callersMethod_refresh_global_stats
(self)
verl/verl/experimental/vla/sac/replay_pool.py:462
↓ 2 callersMethod_remove_generation_prompt_ids_if_present
Remove generation prompt IDs from input tensors if they are present at the end.
verl/verl/workers/rollout/schemas.py:541
↓ 2 callersMethod_remove_hooks
Remove all registered hooks.
verl/verl/models/transformers/tiled_mlp.py:75
↓ 2 callersMethod_reset_metrics
(self, env_idx=None)
verl/verl/experimental/vla/envs/isaac_env/isaac_env.py:120
↓ 2 callersMethod_reset_metrics
(self, env_idx=None)
verl/verl/experimental/vla/envs/libero_env/libero_env.py:227
↓ 2 callersFunction_resolve_device
Resolve device according to policy described in the module docstring. Priority: 1) explicit argument 2) VERL_FORCE_DEVICE env
verl/verl/utils/groupwise.py:54
↓ 2 callersMethod_run_agent_loop
( self, sampling_params: dict[str, Any], trajectory: dict[str, Any], *,
verl/verl/experimental/agent_loop/agent_loop.py:606
↓ 2 callersMethod_run_diffusion_prediction
Run diffusion-based action prediction
verl/verl/experimental/vla/models/openvla_oft/modeling_prismatic.py:1410
↓ 2 callersMethod_run_sleep_logic
Simulate the sleep() method's tag selection logic and return chosen tags.
verl/tests/workers/rollout/rollout_sglang/test_lora_sleep_level.py:166
↓ 2 callersMethod_sample_actions_flow_sde
add noise to the action sampling process using Flow-SDE method. see https://arxiv.org/abs/2510.25889
verl/verl/experimental/vla/models/pi0_torch/modeling_pi0_torch.py:375
↓ 2 callersMethod_sample_from_task_pools
(self, batch_size: int, is_positive_pool: bool)
verl/verl/experimental/vla/sac/replay_pool.py:397
↓ 2 callersMethod_save_checkpoint
Save actor, critic, and dataloader checkpoints to local (and optionally remote) storage.
verl/verl/trainer/main_ppo_sync.py:766
↓ 2 callersFunction_save_param_meta
(layer: torch.nn.Module, param_name: str)
verl/verl/utils/modelopt/vllm_modelopt_patch.py:26
↓ 2 callersFunction_save_weight_loaders
(layer: torch.nn.Module, param_names: list[str])
verl/verl/utils/modelopt/vllm_modelopt_patch.py:86
↓ 2 callersFunction_select_fsdp2_wrap_targets
Select modules to wrap individually with fully_shard in FSDP2. Matches transformer layers by class name, and embed_tokens/lm_head by name (wi
verl/verl/utils/fsdp_utils.py:510
↓ 2 callersFunction_sequence_max
(values: torch.Tensor)
verl/verl/trainer/ppo/rollout_corr_helper.py:277
↓ 2 callersMethod_should_pause_generation
Determine whether the build should be paused
verl/verl/experimental/fully_async_policy/fully_async_rollouter.py:643
↓ 2 callersMethod_should_profile_this_rank
(self)
verl/verl/utils/profiler/profile.py:271
↓ 2 callersFunction_split_args_kwargs_data_proto
(chunks, *args, **kwargs)
verl/verl/single_controller/base/decorator.py:71
↓ 2 callersMethod_start_profiling
Start profiling for all worker groups including env workers.
verl/verl/experimental/vla/rob_ray_trainer.py:113
↓ 2 callersMethod_stop_profiling
Stop profiling for all worker groups including env workers.
verl/verl/experimental/vla/rob_ray_trainer.py:119
↓ 2 callersFunction_strip_properly_formatted_commas
(expr: str)
verl/verl/utils/reward_score/prime_math/__init__.py:115
↓ 2 callersMethod_sync_metadata
(self, group)
verl/verl/utils/modelopt/qat_weight_exporter.py:174
↓ 2 callersFunction_test_add_tool_response_messages_image_delta
(processor, image_list, description_list, resize_image=False)
verl/tests/workers/rollout/test_sglang_async_rollout_multimodal_delta.py:31
↓ 2 callersFunction_to_nested
Strip padding from (bs, seq_len, dim) embeds using the boolean mask and return nested tensors.
verl/verl/workers/utils/padding.py:164
↓ 2 callersMethod_touch
Update LRU order.
infinity/memory/manager.py:72
↓ 2 callersFunction_unnormalize
(x: torch.Tensor, min_val: float, max_val: float)
verl/verl/experimental/vla/models/pi0_torch/pi0_utils.py:323
↓ 2 callersMethod_unnormalize_actions
Unnormalize actions using dataset statistics
verl/verl/experimental/vla/models/openvla_oft/modeling_prismatic.py:1389
↓ 2 callersMethod_unpad_nested_embeds
Convert a jagged nested tensor pair (embeds, mask) to dense padded tensors.
verl/verl/workers/engine/fsdp/diffusers_impl.py:513
↓ 2 callersFunction_unpad_tensor
(x: Tensor, dim: int, padding_size: int)
verl/verl/utils/ulysses.py:111
↓ 2 callersMethod_update_actor
Update the actor network.
verl/verl/trainer/main_ppo_sync.py:1222
↓ 2 callersMethod_update_critic
Update the critic network.
verl/verl/trainer/main_ppo_sync.py:1200
↓ 2 callersMethod_val_metrics_update
(self, data_sources, sample_uids, reward_extra_infos_dict, sample_turns)
verl/verl/trainer/ppo/ray_trainer.py:653
↓ 2 callersMethod_validate
(self, merged: bool = False)
verl/verl/trainer/ppo/ray_trainer.py:528
↓ 2 callersMethod_validate
(self)
verl/verl/experimental/vla/sac/sac_ray_trainer.py:462
↓ 2 callersMethod_validate_bbox
Validate the bounding box dimensions and aspect ratio.
verl/verl/tools/image_zoom_in_tool.py:181
↓ 2 callersMethod_wait_for_layer
Block until layer idx is ready.
infinity/scheduler/admission_control.py:138
↓ 2 callersMethod_wait_ready
Ensure layer is ready for compute.
infinity/scheduler/sliding_window.py:72
↓ 2 callersFunction_worker_sync_gpu_modules
Refresh worker's GPU modules from shared CPU master params.
infinity/model/mp_worker.py:196
↓ 2 callersMethod_wrap_obs
(self, obs_list)
verl/verl/experimental/vla/envs/libero_env/libero_env.py:267
↓ 2 callersMethodacquire
Acquire a token from the bucket.
verl/verl/tools/search_tool.py:58
↓ 2 callersMethodacquire_slot
Get a GPU slot for tensor_id. Returns None if eviction needed.
infinity/memory/manager.py:34
↓ 2 callersMethodadd
(self, data: DataProto)
verl/tests/single_controller/test_colocated_workers_fused.py:35
↓ 2 callersMethodadd
(self, data: DataProto)
verl/tests/single_controller/test_colocated_workers.py:35
↓ 2 callersMethodadd
(self, x)
verl/tests/single_controller/test_fused_workers_on_cpu.py:33
↓ 2 callersMethodadd_assistant_message
( self, processing_class: PreTrainedTokenizer | PreTrainedTokenizerFast | ProcessorMixin,
verl/verl/workers/rollout/schemas.py:395
↓ 2 callersFunctionadd_base_layer_suffix
Yield param pairs with a base-layer suffix added to the param name. Args: params: Iterator of (param_name, tensor) model_type: Th
verl/verl/utils/megatron_peft_utils.py:159
↓ 2 callersMethodadd_batch
Add a batch of samples into task-specific positive/negative pools.
verl/verl/experimental/vla/sac/replay_pool.py:65
↓ 2 callersMethodadd_compute
Add a compute operation.
infinity/scheduler/graph.py:41
↓ 2 callersMethodadd_data_stream
Simulate data stream
verl/verl/experimental/fully_async_policy/unittest/simple_streaming_demo.py:47
↓ 2 callersMethodadd_grad
Accumulate gradient (handles device/dtype conversion).
infinity/optimizer.py:31
↓ 2 callersMethodadd_remote_agent
(self, metadata: NixlAgentMetadata)
verl/verl/checkpoint_engine/nixl_checkpoint_engine.py:97
↓ 2 callersFunctionadd_token2text
(self, result)
verl/verl/utils/rollout_trace.py:199
↓ 2 callersFunctionall_gather_data_proto
(data: DataProto, process_group)
verl/verl/protocol.py:1326
↓ 2 callersFunctionall_to_all_tensor
( local_input: Tensor, scatter_dim: int, gather_dim: int, group: Optional[dist.ProcessGroup] =
verl/verl/utils/ulysses.py:133
↓ 2 callersFunctionallgather_dict_into_dict
allgather a dict into a dict of list Args: data: a dict group: the process group to allgather Returns: dict containing a lis
verl/verl/utils/torch_functional.py:450
↓ 2 callersFunctionapply_bypass_mode
Setup bypass mode: Use rollout_log_probs as old_log_probs. Bypass mode skips expensive actor forward pass for old_log_prob computation b
verl/verl/trainer/ppo/rollout_corr_helper.py:1102
↓ 2 callersFunctionapply_fsdp2
Apply FSDP2 sharding to model.
verl/tests/models/test_tiled_mlp_accuracy.py:51
↓ 2 callersFunctionapply_modelopt_nvfp4_patches
Apply ModelOpt NVFP4 patches to support dynamic weight updates. Call before model loading.
verl/verl/utils/modelopt/vllm_modelopt_patch.py:554
↓ 2 callersFunctionapply_npu_fsdp_patches
Apply NPU patches for FSDP backend if NPU is available.
verl/verl/workers/engine/fsdp/utils.py:26
↓ 2 callersFunctionapply_patch
()
verl/verl/models/mcore/patch.py:20
↓ 2 callersFunctionapply_qat
Apply QAT to a model by replacing nn.Linear with QATLinear.
verl/verl/utils/qat/core.py:87
← previousnext →801–900 of 5,181, ranked by callers