MCPcopy Create free account

hub / github.com/Unakar/Logic-RL / functions

Functions858 in github.com/Unakar/Logic-RL

Methodget_vocab
(self)
tests/e2e/envs/digit_completion/tokenizer.py:89
Methodget_weight_buffer_meta
(self)
verl/utils/memory_buffer.py:156
Functiongreedy_partition
(seqlen_list: List[int], k_partitions: int, equal_size: bool)
verl/utils/seqlen_balancing.py:133
Functioninit_fn
(x: torch.nn.Module)
verl/utils/fsdp_utils.py:29
Methodinit_megatron
(self, default_megatron_kwargs: Dict = None)
verl/single_controller/base/megatron/worker_group.py:28
Methodinit_model
(self)
verl/workers/megatron_workers.py:261
Methodinit_model
(self)
verl/workers/megatron_workers.py:514
Methodinit_model
(self)
verl/workers/megatron_workers.py:672
Methodinit_model
(self)
verl/workers/fsdp_workers.py:285
Methodinit_model
(self)
verl/workers/fsdp_workers.py:851
Methodinitialize_weight_buffer
Initialize the weight buffer. The weight buffer is obtained according to the actor. We will construct a large buffer for each dtype i
verl/utils/memory_buffer.py:181
Functioninner
(*args, **kwargs)
verl/single_controller/base/decorator.py:401
Methodis_bf16
(precision)
verl/utils/torch_dtypes.py:59
Methodis_fast
(self)
verl/workers/rollout/tokenizer.py:161
Methodis_fp16
(precision)
verl/utils/torch_dtypes.py:51
Methodis_fp32
(precision)
verl/utils/torch_dtypes.py:55
Functionis_sequence_parallel_param
(param)
verl/utils/megatron/sequence_parallel.py:25
Functionkl_penalty
Compute KL divergence given logprob and ref_logprob. Copied from https://github.com/huggingface/trl/blob/main/trl/trainer/ppo_trainer.py#L1104
verl/trainer/ppo/core_algos.py:279
Functionllama_flash_attn_forward
adapt from transformers 4.47.1
verl/models/transformers/llama.py:27
Methodload_checkpoint
(self, checkpoint_path)
verl/workers/megatron_workers.py:395
Methodload_checkpoint
(self, checkpoint_path)
verl/workers/megatron_workers.py:568
Functionload_fsdp_grad
(module, device_id)
verl/utils/fsdp_utils.py:86
Methodload_pretrained_model
(self, checkpoint_path)
verl/workers/megatron_workers.py:399
Functionload_state_dict_to_megatron_llama
Load merged state_dict to sharded Megatron module in training.
verl/models/llama/megatron/checkpoint_utils/llama_loader.py:51
Methodlocal_rank_list
(self)
verl/single_controller/base/worker_group.py:55
Methodlocal_world_size_list
(self)
verl/single_controller/base/worker_group.py:49
Methodlog
(self, data, step)
verl/utils/tracking.py:67
Functionlogprobs_of_labels_v2
A memory efficient implementation of logprobs_from_logits
verl/utils/torch_functional.py:76
Methodloss_func
(output, data, meta_info)
verl/workers/critic/megatron_critic.py:135
Methodloss_func
(output, data, meta_info)
verl/workers/actor/megatron_actor.py:249
Methodloss_func
(output)
verl/workers/reward_model/megatron/reward_model.py:219
Functionlr_lambda
(current_step)
verl/utils/torch_functional.py:412
Functionmain_task
(config)
verl/trainer/main_ppo.py:109
Functionmain_task
(config)
examples/split_placement/main_ppo_split.py:102
Methodmake_minibatch_iterator
(self, data: DataProto)
verl/workers/critic/megatron_critic.py:106
Functionmark_parameter_as_sequence_parallel
(parameter)
verl/utils/megatron/sequence_parallel.py:21
Functionmasked_sum
Compute mean of tensor with a masked values.
verl/utils/torch_functional.py:102
Functionmasked_whiten
Whiten values with masked values.
verl/utils/torch_functional.py:130
Methodmaster_address
(self)
verl/single_controller/ray/base.py:354
Methodmaster_port
(self)
verl/single_controller/ray/base.py:358
Methodmegatron_actor_model_provider
(pre_process, post_process)
tests/ray/detached_worker/server.py:93
Methodmegatron_actor_model_provider
(pre_process, post_process)
verl/workers/megatron_workers.py:154
Methodmegatron_critic_model_provider
(pre_process, post_process)
verl/workers/megatron_workers.py:476
Methodmegatron_rm_model_provider
(pre_process, post_process)
verl/workers/megatron_workers.py:638
Methodmemory_buffers
(self)
verl/utils/memory_buffer.py:213
Methodmerge
(self, other)
verl/utils/seqlen_balancing.py:72
Functionmerge_megatron_ckpt_llama
Merge sharded parameters of a Megatron module into a merged checkpoint. Args: wrapped_modelss (list of megatron.model.DistributedDataPara
verl/models/llama/megatron/checkpoint_utils/llama_saver.py:76
Functionmeta_device_init
Create model parameters with meta device. Note buffers in model will still be initialized in default device (e.g., CPU), since the buffe
verl/utils/fsdp_utils.py:134
Functionnum_tokens_from_string
(string)
eval_kk/kk_processor.py:6
Functionpad_packed_inputs
pad the tokens such that the total length is a multiple of size. This function is useful when applying sequence parallel and context parallel
verl/utils/model.py:299
Methodpad_token_id
`Optional[int]`: Id of the padding token in the vocabulary. Returns `None` if the token has not been set.
verl/workers/rollout/tokenizer.py:36
Functionparallel_init_module_fn
Generate a function to initialize sub-modules in the `module` with `shard_states` from huggingface checkpoint. Args: module (tor
verl/utils/fsdp_utils.py:221
Functionparallel_load_safetensors
Parallel load safetensors from huggingface checkpoint Huggingface checkpoint contains: - config.json: a json file for model configurati
verl/utils/fsdp_utils.py:165
Functionpost_process_logits
(input_ids, logits, temperature, top_k, top_p)
verl/utils/torch_functional.py:359
Methodpostprocess_data
(self, data: DataProto)
verl/workers/sharding_manager/fsdp_vllm.py:121
Methodpostprocess_data
Split the data to follow FSDP partition
verl/workers/sharding_manager/fsdp_ulysses.py:80
Methodpostprocess_data
(self, data: DataProto)
verl/workers/sharding_manager/megatron_vllm.py:394
Methodpp_group
(self)
verl/workers/sharding_manager/megatron_vllm.py:203
Methodpp_models
(self)
verl/workers/sharding_manager/megatron_vllm.py:207
Methodpp_rank
(self)
verl/workers/sharding_manager/megatron_vllm.py:199
Methodpp_size
(self)
verl/single_controller/base/megatron/worker_group.py:46
Methodpp_size
(self)
verl/workers/sharding_manager/megatron_vllm.py:195
Functionprepare_decoder_attention_mask
(attention_mask, input_shape, inputs_embeds)
verl/utils/torch_functional.py:434
Methodpreprocess_data
(self, data: DataProto)
verl/workers/sharding_manager/fsdp_vllm.py:112
Methodpreprocess_data
(self, data: DataProto)
verl/workers/sharding_manager/megatron_vllm.py:378
Methodprint_size
(self, prefix="")
verl/protocol.py:225
Functionprocess
(iter)
verl/utils/debug/trajectory_tracker.py:94
Functionprocess_fn
(doc, idx)
examples/data_preprocess/hellaswag.py:55
Functionprocess_fn
(example, idx)
examples/data_preprocess/countdown.py:95
Functionprocess_fn
(example, idx)
examples/data_preprocess/kk.py:47
Functionprocess_fn
(example, idx)
examples/data_preprocess/full_hh_rlhf.py:95
Functionprocess_fn
(example, idx)
examples/data_preprocess/gsm8k.py:54
Functionprocess_fn
(example, idx)
examples/data_preprocess/multiply.py:100
Functionprocess_fn
(example, idx)
examples/data_preprocess/arth.py:111
Functionprocess_fn
(example, idx)
examples/data_preprocess/math_dataset.py:50
Methodprompt_length
(self)
tests/e2e/envs/digit_completion/task.py:69
Functionput_data
(index, data)
verl/utils/ray_utils.py:25
Functionqwen2_flash_attn_forward
( self, hidden_states: torch.Tensor, attention_mask: Optional[torch.Tensor] = None,
verl/models/transformers/qwen2.py:28
Functionregister
(dispatch_mode=Dispatch.ALL_TO_ALL, execute_mode=Execute.ALL, blocking=True, materialize_futures=True)
verl/single_controller/base/decorator.py:394
Functionregister_empty_parameter
(module, name, param)
verl/utils/fsdp_utils.py:146
Functionremote_call_wg
(worker_names)
tests/ray/test_worker_group_basics.py:69
Functionremove_pad_token
Remove the pad token. Args: input_ids shape: [bs, seq_length] attention_mask shape: [bs, seq_length] Returns: no_pa
verl/utils/torch_functional.py:269
Methodrename
Note that this function only rename the key in the batch
verl/protocol.py:397
Methodresponse_length
(self)
tests/e2e/envs/digit_completion/task.py:73
Methodsample_batch_str_prompts
(self, batch_size)
tests/e2e/envs/digit_completion/task.py:100
Methodsave_checkpoint
(self, checkpoint_path)
verl/workers/megatron_workers.py:403
Methodsave_checkpoint
(self, checkpoint_path)
verl/workers/megatron_workers.py:572
Methodsave_checkpoint
(self, local_path, hdfs_path=None)
verl/workers/fsdp_workers.py:478
Functionsave_to_hdfs
(data: io.BytesIO, name, hdfs_dir, verbose)
verl/utils/debug/trajectory_tracker.py:33
Methodseries_to_item
(ls)
verl/utils/dataset/sft_dataset.py:75
Methodset_additional_resource
(self, additional_resource)
verl/single_controller/ray/base.py:136
Methodset_input_tensor
Set input tensor to be used instead of forward()'s input. When doing pipeline parallelism the input from the previous stage comes fro
verl/models/llama/megatron/modeling_llama_megatron.py:531
Methodset_state
(self, state)
tests/e2e/envs/digit_completion/task.py:64
Methodspread
(self)
verl/utils/seqlen_balancing.py:60
Functionsqueeze
(x)
verl/utils/model.py:38
Methodstore
(self)
verl/single_controller/base/worker_group.py:46
Methodsupported_type
(precision: Union[str, int])
verl/utils/torch_dtypes.py:43
Methodsupported_types
()
verl/utils/torch_dtypes.py:47
Functiontest
()
tests/ray/test_high_level_scheduling_api.py:33
Functiontest
()
tests/ray/test_driverfunc_to_worker.py:55
← previousnext →701–800 of 858, ranked by callers