MCPcopy Create free account

hub / github.com/DLYuanGod/MegaTrain / functions

Functions5,181 in github.com/DLYuanGod/MegaTrain

↓ 3 callersFunctionvocab_parallel_entropy
Compute entropy when the logits are sharded in tp ranks Args: vocab_parallel_logits: (total_nnz, vocab_size // tp_size) Returns: (to
verl/verl/utils/megatron/tensor_parallel.py:142
↓ 3 callersFunctionvocab_parallel_log_probs_from_logits
TODO(zhangchi.usc1992): We may change the implementation later
verl/verl/utils/megatron/tensor_parallel.py:154
↓ 3 callersMethodwait_for_complete
(self, buf: torch.Tensor)
verl/verl/checkpoint_engine/mooncake_checkpoint_engine.py:142
↓ 2 callersMethod__init__
(self, hidden_size)
infinity/true_cpu_offloading.py:273
↓ 2 callersMethod__init__
(self, vocab_size=1000, hidden_size=64, num_layers=2, tie_word_embeddings=False)
verl/tests/utils/test_fsdp2_peft_wrapping.py:57
↓ 2 callersMethod__init__
(self, config: RolloutConfig, model_config: HFModelConfig, check_allclose: bool = True)
verl/tests/checkpoint_engine/test_utils.py:53
↓ 2 callersMethod__init__
(self)
verl/verl/utils/activation_offload.py:93
↓ 2 callersMethod__init__
( self, config: DictConfig, role_worker_mapping: dict[Role, WorkerType], resou
verl/verl/trainer/main_ppo_sync.py:492
↓ 2 callersMethod__init__
(self, config: McoreCriticConfig)
verl/verl/workers/megatron_workers.py:1024
↓ 2 callersMethod__init__
(self, config: FSDPCriticConfig)
verl/verl/workers/fsdp_workers.py:1314
↓ 2 callersMethod__init__
(self, config: TrainingWorkerConfig)
verl/verl/workers/engine_workers.py:82
↓ 2 callersMethod__init__
( self, model_config: HFModelConfig, engine_config: McoreEngineConfig, optimiz
verl/verl/workers/engine/megatron/transformer_impl.py:72
↓ 2 callersMethod__init__
Initialize the VeOmniEngine. Sets up distributed device meshes, LoRA, and offload policies based on config. Args:
verl/verl/workers/engine/veomni/transformer_impl.py:60
↓ 2 callersMethod__init__
Initialize the FSDPEngine. Sets up distributed device meshes, LoRA, and offload policies based on config. Args:
verl/verl/workers/engine/fsdp/transformer_impl.py:91
↓ 2 callersMethod__init__
(self, engine: DiffusersFSDPEngine, **kwargs)
verl/verl/workers/engine/fsdp/diffusers_impl.py:793
↓ 2 callersMethod__init__
( self, model_config: HFModelConfig, engine_config: AutomodelEngineConfig, opt
verl/verl/workers/engine/automodel/transformer_impl.py:74
↓ 2 callersMethod__init__
Initialize the TorchTitanEngine. Sets up distributed device meshes for tensor and data parallelism, LoRA, and offload policies.
verl/verl/workers/engine/torchtitan/transformer_impl.py:80
↓ 2 callersMethod__init__
( self, patch_size: int = 14, temporal_patch_size: int = 2, in_channels: int =
verl/verl/models/mcore/qwen2_5_vl/vision_model.py:35
↓ 2 callersMethod__init__
( self, retrieval_method: str = "bm25", retrieval_topk: int = 10, index_path:
verl/examples/sglang_multiturn/search_r1_like/local_dense_retriever/retrieval_server.py:291
↓ 2 callersMethod__post_init__
(self)
verl/verl/workers/config/optimizer.py:57
↓ 2 callersMethod_accumulate_grads_batch
Wait for CPU worker to finish all gradient accumulation tasks.
infinity/model/cpu_master.py:975
↓ 2 callersMethod_async_gen_next_batch
Call parameter synchronization and asynchronous sequence generation.
verl/verl/experimental/one_step_off_policy/ray_trainer.py:197
↓ 2 callersFunction_async_meta_to_realdata
(meta: BatchMeta)
verl/verl/utils/transferqueue_utils.py:111
↓ 2 callersFunction_broadcast_tp_shard_tensor_qkv
broadcast tensor in tp shards across mp_group
verl/verl/models/mcore/saver.py:271
↓ 2 callersFunction_broadcast_tp_shard_tensor_qkv
broadcast tensor in tp shards across mp_group
verl/verl/models/mcore/loader.py:288
↓ 2 callersMethod_build_kv_cache_from_prefix
Build KV cache for prefix. No grad needed.
verl/verl/experimental/vla/models/pi0_torch/modeling_pi0_torch.py:460
↓ 2 callersMethod_build_layer_kwargs
Build kwargs dict for layer forward, based on what the layer accepts.
infinity/model/cpu_master.py:929
↓ 2 callersMethod_build_messages
Replace <image> and <video> placeholder in messages with corresponding image and video which is required by processor.apply_chat_template.
verl/verl/utils/dataset/rl_dataset.py:303
↓ 2 callersMethod_build_model_optimizer
( self, model_path, optim_config, override_model_config, override_transformer_config, override_ddp_con
verl/verl/workers/megatron_workers.py:396
↓ 2 callersMethod_build_rollout_config
(*, response_length: int | None = None, free_cache_engine: bool = False)
verl/tests/workers/rollout/rollout_trtllm/test_async_server.py:112
↓ 2 callersFunction_check_first_call
(layer: torch.nn.Module)
verl/verl/utils/modelopt/vllm_modelopt_patch.py:80
↓ 2 callersMethod_check_prefetch_completion
Promote completed prefetches to GPU_READY.
infinity/scheduler/admission_control.py:112
↓ 2 callersMethod_check_unnorm_key
Validate and resolve the unnormalization key for action statistics
verl/verl/experimental/vla/models/openvla_oft/modeling_prismatic.py:1976
↓ 2 callersMethod_collect_layer_grads_async
Collect GPU buffer grads to CPU layer using K-slab flat buffer pool.
infinity/model/cpu_master.py:944
↓ 2 callersFunction_compute_fp8_thd_align_size
Compute FP8 alignment sizes for thd-format sequences. For FP8 block quantization, each sequence must be padded to a multiple of lcm(16, align
verl/verl/models/mcore/util.py:32
↓ 2 callersFunction_compute_need_collect
Compute whether data collection is needed for the current worker. This function determines whether the current worker should collect data based o
verl/verl/utils/transferqueue_utils.py:159
↓ 2 callersMethod_compute_ref_log_prob
Compute the reference log prob of the batch.
verl/verl/trainer/main_ppo_sync.py:1085
↓ 2 callersFunction_compute_response_info
Computes information about prompts and responses from a batch. This is an internal helper function that extracts masks and lengths for promp
verl/verl/trainer/ppo/metric_utils.py:51
↓ 2 callersMethod_compute_score
Compute reward score for single sample.
verl/verl/experimental/agent_loop/agent_loop.py:855
↓ 2 callersMethod_compute_values
Compute the values of the batch.
verl/verl/trainer/main_ppo_sync.py:1113
↓ 2 callersFunction_concat_data_proto_or_future
(output: list)
verl/verl/single_controller/base/decorator.py:138
↓ 2 callersMethod_context_switch
(self, device)
verl/verl/workers/engine/base.py:242
↓ 2 callersMethod_convert_attention_param
(self, name: str, params: list[torch.Tensor])
verl/verl/models/mcore/weight_converter.py:270
↓ 2 callersMethod_convert_mlp_param
(self, name: str, params: list[torch.Tensor])
verl/verl/models/mcore/weight_converter.py:309
↓ 2 callersFunction_convert_to_nested_tensor
Convert regular tensor to NestedTensor, slicing according to input_ids_lengths. Args: v: Tensor to convert, shape [batch, seq_len]
verl/verl/models/mcore/model_forward.py:181
↓ 2 callersMethod_create_featurizer
Create a TIMM-based featurizer model with appropriate configurations. Args: model_id: The TIMM model ID to load
verl/verl/experimental/vla/models/openvla_oft/modeling_prismatic.py:131
↓ 2 callersMethod_create_server
(rollout_config, model_config, *, name: str)
verl/tests/workers/rollout/rollout_trtllm/test_async_server.py:137
↓ 2 callersMethod_create_test_data_for_update_policy
Create test DataProto for update_policy method
verl/tests/workers/actor/test_special_dp_actor.py:140
↓ 2 callersMethod_create_worker
(self, rank, pg_idx, pg, local_rank, resource_pool, ray_cls_with_init, worker_env, detached)
verl/verl/single_controller/ray/base.py:617
↓ 2 callersFunction_deep_equal
Recursively performs a deep comparison between two Python objects. - Handles NaN values correctly (NaN == NaN evaluates to True). - Handl
verl/verl/protocol.py:152
↓ 2 callersFunction_discover_model_components
Discover model components via attribute introspection. Supports LLM and VLM models: - LLM: LLaMA, Qwen, Mistral, Phi, Gemma, GPT-2, DeepSeek,
infinity/model/cpu_master.py:59
↓ 2 callersMethod_download
(self, use_origin_parquet=False)
verl/verl/utils/dataset/rl_dataset.py:147
↓ 2 callersFunction_encode_obs
(obs: dict | tuple | np.ndarray, buffer: dict | tuple | ShArray)
verl/verl/experimental/vla/envs/libero_env/venv.py:41
↓ 2 callersFunction_ensure_model_list
(model)
verl/verl/models/mcore/bridge.py:31
↓ 2 callersFunction_estimate_qwen3_vit_flop
Estimate the FLOPS of the vision encoder for Qwen3-VL
verl/verl/utils/flops_counter.py:215
↓ 2 callersMethod_evict
Async evict layer to CPU.
infinity/scheduler/sliding_window.py:55
↓ 2 callersMethod_evict_one
Evict a layer back to CPU.
infinity/scheduler/admission_control.py:121
↓ 2 callersFunction_extract_lora_tensors
Extract LoRA adapter tensors as a list of (name, tensor) tuples. Mimics the base_sync_done=True path — sends adapter deltas via LoadLoRAAdapt
verl/tests/utils/test_special_adapter_path_integration.py:103
↓ 2 callersFunction_find_attr
Try multiple attribute paths, return first match or raise.
infinity/adapters/hf_decoder.py:76
↓ 2 callersFunction_find_meta
(*args, **kwargs)
verl/verl/utils/transferqueue_utils.py:101
↓ 2 callersMethod_fit_experimental
(self, batch)
verl/verl/experimental/separation/ray_trainer.py:723
↓ 2 callersMethod_fit_postprocess_step
(self)
verl/verl/experimental/separation/ray_trainer.py:734
↓ 2 callersMethod_fit_prepare_step
(self)
verl/verl/experimental/separation/ray_trainer.py:378
↓ 2 callersMethod_fit_save_checkpoint
(self)
verl/verl/experimental/separation/ray_trainer.py:657
↓ 2 callersMethod_fit_save_checkpoint
(self, force=False)
verl/verl/experimental/fully_async_policy/fully_async_trainer.py:599
↓ 2 callersMethod_fit_update_weights
(self)
verl/verl/experimental/fully_async_policy/fully_async_trainer.py:509
↓ 2 callersMethod_fit_validate
(self)
verl/verl/experimental/separation/ray_trainer.py:645
↓ 2 callersMethod_fit_validate
(self, val_before_train=False)
verl/verl/experimental/fully_async_policy/fully_async_trainer.py:558
↓ 2 callersMethod_forward_hidden
Run forward pass through all layers and return final hidden states. This is a shared helper used by both inference and training paths.
infinity/model/cpu_master.py:1094
↓ 2 callersMethod_forward_micro_batch
(self, micro_batch)
verl/verl/workers/critic/dp_critic.py:53
↓ 2 callersMethod_forward_micro_batch
Returns: dict[str, torch.Tensor]: log_probs: (bs, response_len) if calculate_entropy is True:
verl/verl/workers/actor/dp_actor.py:115
↓ 2 callersFunction_generate_weights
Deterministically generate weights on the best available device from specs. Args: weight_specs: list of (name, shape, dtype) tuples
verl/tests/utils/test_bucketed_weight_transfer.py:41
↓ 2 callersMethod_get_data_parallel_mesh
Get the data parallel mesh, handling hybrid/fully/replicate shard modes.
verl/verl/workers/engine/torchtitan/transformer_impl.py:307
↓ 2 callersMethod_get_gen_batch
(self, batch: DataProto)
verl/verl/trainer/ppo/ray_trainer.py:493
↓ 2 callersFunction_get_input_embeds
( model: "Qwen2VLForConditionalGeneration", input_ids: torch.LongTensor, attention_mask: Optional[
verl/verl/models/transformers/qwen2_vl.py:342
↓ 2 callersMethod_get_master_addr_port
Get master addr and port for this worker group
verl/verl/single_controller/ray/base.py:514
↓ 2 callersFunction_get_patching_model
(model: torch.nn.Module)
verl/verl/models/mcore/model_forward_fused.py:40
↓ 2 callersMethod_get_path_dump
Return the directory path for a given gen_step (one dir per step, no .pkl).
verl/verl/utils/rollout_skip.py:145
↓ 2 callersMethod_get_path_step_record
(self)
verl/verl/utils/rollout_skip.py:151
↓ 2 callersMethod_get_position_ids
( processing_class: PreTrainedTokenizer | PreTrainedTokenizerFast | ProcessorMixin, input_ids:
verl/verl/workers/rollout/schemas.py:261
↓ 2 callersFunction_get_qat_field
Extract a field from qat_config, supporting both dict and object-style access.
verl/verl/utils/modelopt/qat_utils.py:32
↓ 2 callersMethod_get_session
Context manager for safe session access with proper connection pooling. Yields: aiohttp.ClientSession: Session instance for makin
verl/verl/workers/rollout/sglang_rollout/http_server_engine.py:629
↓ 2 callersMethod_get_task_and_trial_ids_from_reset_state_ids
(self, reset_state_ids)
verl/verl/experimental/vla/envs/libero_env/libero_env.py:193
↓ 2 callersMethod_get_tp_pp_rank_from_sharded_dir
(self, sharded_dir: str)
verl/scripts/legacy_model_merger.py:484
↓ 2 callersMethod_gripper_from_angular
(self, value: torch.Tensor)
verl/verl/experimental/vla/models/pi0_torch/pi0_utils.py:258
↓ 2 callersMethod_gripper_from_angular_inv
(self, value: torch.Tensor)
verl/verl/experimental/vla/models/pi0_torch/pi0_utils.py:157
↓ 2 callersMethod_gripper_to_angular
(self, value: torch.Tensor)
verl/verl/experimental/vla/models/pi0_torch/pi0_utils.py:162
↓ 2 callersMethod_init_agent_loop_workers
(self)
verl/verl/experimental/agent_loop/agent_loop.py:1128
↓ 2 callersMethod_init_async_rollout_manager
(self)
verl/verl/experimental/fully_async_policy/fully_async_rollouter.py:380
↓ 2 callersMethod_init_global_load_balancer
(self)
verl/verl/experimental/agent_loop/agent_loop.py:1163
↓ 2 callersMethod_init_hf_config_and_tf_config
( self, model_path, tokenizer_or_path, dtype, override_model_config,
verl/verl/workers/megatron_workers.py:109
↓ 2 callersMethod_init_qat_config
Initialize QAT configuration from actor.qat.
verl/verl/workers/fsdp_workers.py:287
↓ 2 callersMethod_init_resource_pools
(self)
verl/verl/experimental/separation/ray_trainer.py:128
↓ 2 callersMethod_init_reward_loop
(self)
verl/verl/experimental/fully_async_policy/fully_async_trainer.py:327
↓ 2 callersMethod_init_worker_groups
(self)
verl/verl/experimental/separation/ray_trainer.py:193
↓ 2 callersMethod_initialize_llm_servers
(self)
verl/verl/experimental/agent_loop/agent_loop.py:1081
↓ 2 callersMethod_insert_block_to_pool
Insert a block of data from source into one task pool.
verl/verl/experimental/vla/sac/replay_pool.py:299
↓ 2 callersFunction_introspect_layer_forward
Introspect a layer's forward signature to determine accepted kwargs. Returns a set of accepted parameter names.
infinity/model/cpu_master.py:266
↓ 2 callersMethod_is_amax_initialized
Check if input_amax has been initialized.
verl/verl/utils/qat/linear.py:264
↓ 2 callersFunction_is_frac
(expr: str)
verl/verl/utils/reward_score/prime_math/__init__.py:86
← previousnext →701–800 of 5,181, ranked by callers