MCPcopy Create free account

hub / github.com/ChenxinAn-fdu/POLARIS / functions

Functions1,563 in github.com/ChenxinAn-fdu/POLARIS

↓ 2 callersMethodupdate_policy
Update the policy with an iterator of DataProto Args: data (DataProto): an iterator over the DataProto that returns by
verl/verl/workers/actor/base.py:55
↓ 2 callersMethodupdate_sampling_params
(self, **kwargs)
verl/verl/workers/rollout/sglang_rollout/async_sglang_rollout.py:267
↓ 2 callersMethodupdate_sampling_params
(self, **kwargs)
verl/verl/workers/rollout/vllm_rollout/fire_vllm_rollout.py:84
↓ 2 callersFunctionupload_model_to_huggingface
(hf_path)
verl/scripts/model_merger.py:81
↓ 2 callersMethodvalidation_step
(self, batch: TensorDict)
verl/verl/trainer/fsdp_sft_trainer.py:405
↓ 2 callersMethodverify
(self, data)
verl/verl/workers/reward_manager/batch.py:30
↓ 2 callersFunctionvocab_parallel_entropy
Compute entropy when the logits are sharded in tp ranks Args: vocab_parallel_logits: (total_nnz, vocab_size // tp_size) Returns: (to
verl/verl/utils/megatron/tensor_parallel.py:134
↓ 1 callersMethod__enter__
(self)
verl/verl/workers/sharding_manager/base.py:22
↓ 1 callersMethod__exit__
(self, exc_type, exc_value, traceback)
verl/verl/workers/sharding_manager/base.py:25
↓ 1 callersMethod__init__
(self)
verl/tests/ray_cpu/test_fused_workers.py:24
↓ 1 callersMethod__init__
(self)
verl/tests/rollout/test_vllm_tool_calling.py:53
↓ 1 callersMethod__init__
(self, size)
verl/tests/ray_gpu/test_worker_group_torch.py:30
↓ 1 callersMethod__init__
(self)
verl/tests/ray_gpu/test_colocated_workers_fused.py:30
↓ 1 callersMethod__init__
(self)
verl/tests/ray_gpu/test_colocated_workers.py:30
↓ 1 callersMethod__init__
(self, numel: int, numel_padded: int, dtype: torch.dtype, source: Optional[torch.Tensor] = None)
verl/verl/utils/memory_buffer.py:30
↓ 1 callersMethod__init__
( self, resource_pool: RayResourcePool, ray_cls_with_init: RayClassWithInitArgs,
verl/verl/single_controller/ray/megatron.py:44
↓ 1 callersMethod__init__
( self, module: FSDP, inference_engine: Union[VerlEngine, Engine], model_confi
verl/verl/workers/sharding_manager/fsdp_sglang.py:66
↓ 1 callersMethod__init__
(self, config: Qwen2Config, megatron_config: ModelParallelConfig, layer_idx: int)
verl/verl/models/qwen2/megatron/layers/parallel_decoder.py:36
↓ 1 callersMethod__init__
( self, input_size, num_heads, num_key_value_heads, head_dim,
verl/verl/models/qwen2/megatron/layers/parallel_linear.py:21
↓ 1 callersMethod__init__
(self, config: LlamaConfig, megatron_config: ModelParallelConfig, layer_idx: int)
verl/verl/models/llama/megatron/layers/parallel_decoder.py:36
↓ 1 callersMethod_async_rollout_a_request
(self, req: AsyncRolloutRequest, do_sample: bool = True, is_validate: bool = False, **kwargs)
verl/verl/workers/rollout/sglang_rollout/async_sglang_rollout.py:426
↓ 1 callersFunction_bind_workers_method_to_parent
Binds the methods of each worker to the WorkerDict. Note that we only bind public methods that are decorated by register
verl/verl/single_controller/ray/base.py:440
↓ 1 callersMethod_block_until_all_workers_alive
(self)
verl/verl/single_controller/base/worker_group.py:121
↓ 1 callersFunction_broadcast_tp_shard_tensor_gate_up
broadcast tensor in tp shards across mp_group
verl/verl/models/qwen2/megatron/checkpoint_utils/qwen2_loader_depracated.py:217
↓ 1 callersFunction_broadcast_tp_shard_tensor_gate_up
broadcast tensor in tp shards across mp_group
verl/verl/models/qwen2/megatron/checkpoint_utils/qwen2_saver.py:198
↓ 1 callersFunction_broadcast_tp_shard_tensor_gate_up
broadcast tensor in tp shards across mp_group
verl/verl/models/mcore/saver.py:209
↓ 1 callersFunction_broadcast_tp_shard_tensor_gate_up
broadcast tensor in tp shards across mp_group
verl/verl/models/mcore/loader.py:222
↓ 1 callersFunction_broadcast_tp_shard_tensor_gate_up
broadcast tensor in tp shards across mp_group
verl/verl/models/llama/megatron/checkpoint_utils/llama_saver.py:198
↓ 1 callersFunction_broadcast_tp_shard_tensor_gate_up
broadcast tensor in tp shards across mp_group
verl/verl/models/llama/megatron/checkpoint_utils/llama_loader_depracated.py:219
↓ 1 callersFunction_broadcast_tp_shard_tensor_qkv
broadcast tensor in tp shards across mp_group
verl/verl/models/llama/megatron/checkpoint_utils/llama_saver.py:247
↓ 1 callersFunction_broadcast_tp_shard_tensor_qkv
broadcast tensor in tp shards across mp_group
verl/verl/models/llama/megatron/checkpoint_utils/llama_loader_depracated.py:267
↓ 1 callersFunction_broadcast_tp_shard_tensor_vocab
broadcast tensor in tp shards across mp_group
verl/verl/models/qwen2/megatron/checkpoint_utils/qwen2_loader_depracated.py:126
↓ 1 callersFunction_broadcast_tp_shard_tensor_vocab
broadcast tensor in tp shards across mp_group
verl/verl/models/mcore/loader.py:131
↓ 1 callersFunction_broadcast_tp_shard_tensor_vocab
broadcast tensor in tp shards across mp_group
verl/verl/models/llama/megatron/checkpoint_utils/llama_loader_depracated.py:128
↓ 1 callersMethod_build_critic_model_optimizer
(self, model_path, optim_config, override_model_config)
verl/verl/workers/megatron_workers.py:527
↓ 1 callersMethod_build_critic_model_optimizer
(self, config)
verl/verl/workers/fsdp_workers.py:755
↓ 1 callersMethod_build_dataloader
(self, train_dataset, val_dataset)
verl/verl/trainer/fsdp_sft_trainer.py:123
↓ 1 callersMethod_build_messages
(self, example: dict)
verl/verl/utils/dataset/rl_dataset.py:139
↓ 1 callersMethod_build_model
(self, config)
verl/verl/workers/fsdp_workers.py:1060
↓ 1 callersMethod_build_param_buffer
Build the parameter buffer in each pp rank
verl/verl/workers/sharding_manager/megatron_vllm.py:110
↓ 1 callersMethod_build_reward_ref_model_optimizer
(self, config)
verl/recipe/prime/prime_fsdp_workers.py:83
↓ 1 callersMethod_build_rm_model
(self, model_path, override_model_config)
verl/verl/workers/megatron_workers.py:725
↓ 1 callersMethod_build_rollout
(self, trust_remote_code=False)
verl/verl/workers/megatron_workers.py:211
↓ 1 callersMethod_chat_completions_openai
(self, address: str, **chat_complete_request)
verl/verl/workers/rollout/async_server.py:195
↓ 1 callersFunction_check_and_sort_partitions
(partitions)
verl/verl/utils/seqlen_balancing.py:162
↓ 1 callersFunction_check_dispatch_mode
(dispatch_mode)
verl/verl/single_controller/base/decorator.py:429
↓ 1 callersFunction_check_execute_mode
(execute_mode)
verl/verl/single_controller/base/decorator.py:437
↓ 1 callersMethod_check_resource_available
Check if the resource pool can be satisfied in this ray cluster.
verl/verl/trainer/ppo/ray_trainer.py:121
↓ 1 callersFunction_compute_mlflow_params_from_objects
(params)
verl/verl/utils/tracking.py:155
↓ 1 callersMethod_configure_before_init
(self, register_center_name: str, rank: int)
verl/verl/single_controller/base/worker.py:114
↓ 1 callersMethod_configure_with_meta
This function should only be called inside by WorkerGroup
verl/verl/single_controller/base/worker.py:192
↓ 1 callersMethod_convert_attention_param
(self, name: str, params: list[torch.Tensor])
verl/verl/models/mcore/weight_converter.py:35
↓ 1 callersMethod_convert_mlp_param
(self, name: str, params: list[torch.Tensor])
verl/verl/models/mcore/weight_converter.py:59
↓ 1 callersFunction_copy
(from_path: str, to_path: str, timeout: int = None)
verl/verl/utils/hdfs_io.py:113
↓ 1 callersMethod_create_dataloader
(self, *args, **kwargs)
verl/recipe/prime/prime_ray_trainer.py:172
↓ 1 callersMethod_create_dataloader
Creates the train and validation dataloaders.
verl/verl/trainer/ppo/ray_trainer.py:465
↓ 1 callersFunction_determine_fsdp_megatron_base_class
- megatron: base class should be MegatronWorker - fsdp: base class should be Worker
verl/verl/single_controller/ray/base.py:486
↓ 1 callersMethod_download
(self)
verl/verl/utils/dataset/rm_dataset.py:70
↓ 1 callersMethod_download
(self)
verl/verl/utils/dataset/sft_dataset.py:70
↓ 1 callersMethod_download
(self)
verl/verl/utils/dataset/multiturn_sft_dataset.py:56
↓ 1 callersFunction_exists
hdfs capable to check whether a file_path is exists
verl/verl/utils/hdfs_io.py:43
↓ 1 callersFunction_expand_mask
Expands attention_mask from `[bsz, seq_len]` to `[bsz, 1, tgt_seq_len, src_seq_len]`.
verl/verl/utils/torch_functional.py:477
↓ 1 callersFunction_expand_mask
Expands attention_mask from `[bsz, seq_len]` to `[bsz, 1, tgt_seq_len, src_seq_len]`.
verl/verl/models/qwen2/megatron/modeling_qwen2_megatron.py:60
↓ 1 callersFunction_expand_mask
Expands attention_mask from `[bsz, seq_len]` to `[bsz, 1, tgt_seq_len, src_seq_len]`.
verl/verl/models/llama/megatron/modeling_llama_megatron.py:60
↓ 1 callersMethod_expand_to_token_level
(self, data: DataProto, scores: torch.Tensor)
verl/verl/workers/fsdp_workers.py:1184
↓ 1 callersFunction_fetch_tp_shard_tensor_gate_up
fetch gate_up tensor in tp shards
verl/verl/models/qwen2/megatron/checkpoint_utils/qwen2_loader.py:130
↓ 1 callersFunction_fetch_tp_shard_tensor_gate_up
fetch gate_up tensor in tp shards
verl/verl/models/llama/megatron/checkpoint_utils/llama_loader.py:132
↓ 1 callersFunction_fetch_tp_shard_tensor_qkv
fetch tensor in tp shards across mp_group
verl/verl/models/llama/megatron/checkpoint_utils/llama_loader.py:154
↓ 1 callersFunction_fetch_tp_shard_tensor_vocab
fetch tensor in tp shards
verl/verl/models/qwen2/megatron/checkpoint_utils/qwen2_loader.py:98
↓ 1 callersFunction_fetch_tp_shard_tensor_vocab
fetch tensor in tp shards
verl/verl/models/llama/megatron/checkpoint_utils/llama_loader.py:100
↓ 1 callersFunction_fix_a_slash_b
(string)
verl/verl/utils/reward_score/prime_math/math_normalize.py:90
↓ 1 callersFunction_fix_a_slash_b
(string)
deepscaler/rewards/math_utils/utils.py:60
↓ 1 callersFunction_fix_fracs
(string)
verl/verl/utils/reward_score/prime_math/math_normalize.py:58
↓ 1 callersFunction_fix_fracs
(string)
deepscaler/rewards/math_utils/utils.py:28
↓ 1 callersFunction_fix_sqrt
(string)
verl/verl/utils/reward_score/prime_math/math_normalize.py:115
↓ 1 callersFunction_fix_sqrt
(string)
deepscaler/rewards/math_utils/utils.py:85
↓ 1 callersFunction_flatten_dict
(raw: Dict[str, Any], *, sep: str)
verl/verl/utils/tracking.py:182
↓ 1 callersMethod_forward_head
(self, hidden_states)
verl/verl/models/qwen2/megatron/modeling_qwen2_megatron.py:304
↓ 1 callersMethod_forward_head
(self, hidden_states)
verl/verl/models/qwen2/megatron/modeling_qwen2_megatron.py:608
↓ 1 callersMethod_forward_head
(self, hidden_states)
verl/verl/models/llama/megatron/modeling_llama_megatron.py:304
↓ 1 callersMethod_forward_head
(self, hidden_states)
verl/verl/models/llama/megatron/modeling_llama_megatron.py:561
↓ 1 callersMethod_forward_micro_batch
(self, micro_batch)
verl/verl/workers/fsdp_workers.py:1141
↓ 1 callersMethod_generate_minibatch
(self, prompts: DataProto)
verl/verl/workers/rollout/hf_rollout.py:53
↓ 1 callersFunction_get_cpu_memory
Get the total CPU memory capacity in GB.
verl/scripts/diagnose.py:208
↓ 1 callersFunction_get_current_git_commit
()
verl/scripts/diagnose.py:89
↓ 1 callersFunction_get_free_port
()
verl/tests/rollout/test_vllm_tool_calling.py:39
↓ 1 callersFunction_get_free_port
()
verl/verl/workers/rollout/async_server.py:44
↓ 1 callersMethod_get_free_port
(self)
verl/verl/single_controller/base/worker.py:61
↓ 1 callersFunction_get_gpu_info
Get GPU type, GPU memory, and GPU count using nvidia-smi command.
verl/scripts/diagnose.py:216
↓ 1 callersMethod_get_node_ip
(self)
verl/verl/single_controller/base/worker.py:44
↓ 1 callersFunction_get_parallel_model_architecture_from_config
(config: PretrainedConfig, value=False)
verl/verl/utils/model.py:274
↓ 1 callersFunction_get_system_info
Get CPU memory capacity, GPU type, GPU memory, and GPU count.
verl/scripts/diagnose.py:244
↓ 1 callersFunction_hf_casual_fwd_bwd
(config, sp_size, dp_size)
verl/tests/model/test_transformers_ulysses.py:147
↓ 1 callersFunction_init_args
()
verl/scripts/converter_hf_to_mcore.py:32
↓ 1 callersMethod_init_head
(self, config: Qwen2Config)
verl/verl/models/qwen2/megatron/modeling_qwen2_megatron.py:290
↓ 1 callersMethod_init_head
(self, config)
verl/verl/models/qwen2/megatron/modeling_qwen2_megatron.py:547
↓ 1 callersMethod_init_head
(self, config)
verl/verl/models/llama/megatron/modeling_llama_megatron.py:290
↓ 1 callersMethod_init_head
(self, config)
verl/verl/models/llama/megatron/modeling_llama_megatron.py:547
↓ 1 callersMethod_init_rope
(self)
verl/verl/models/qwen2/megatron/layers/parallel_attention.py:211
↓ 1 callersMethod_init_rope
(self)
verl/verl/models/llama/megatron/layers/parallel_attention.py:232
← previousnext →401–500 of 1,563, ranked by callers