Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/Unakar/Logic-RL
/ functions
Functions
858 in github.com/Unakar/Logic-RL
⨍
Functions
858
◇
Types & classes
113
↳
Endpoints
30
Method
get_vocab
(self)
tests/e2e/envs/digit_completion/tokenizer.py:89
Method
get_weight_buffer_meta
(self)
verl/utils/memory_buffer.py:156
Function
greedy_partition
(seqlen_list: List[int], k_partitions: int, equal_size: bool)
verl/utils/seqlen_balancing.py:133
Function
init_fn
(x: torch.nn.Module)
verl/utils/fsdp_utils.py:29
Method
init_megatron
(self, default_megatron_kwargs: Dict = None)
verl/single_controller/base/megatron/worker_group.py:28
Method
init_model
(self)
verl/workers/megatron_workers.py:261
Method
init_model
(self)
verl/workers/megatron_workers.py:514
Method
init_model
(self)
verl/workers/megatron_workers.py:672
Method
init_model
(self)
verl/workers/fsdp_workers.py:285
Method
init_model
(self)
verl/workers/fsdp_workers.py:851
Method
initialize_weight_buffer
Initialize the weight buffer. The weight buffer is obtained according to the actor. We will construct a large buffer for each dtype i
verl/utils/memory_buffer.py:181
Function
inner
(*args, **kwargs)
verl/single_controller/base/decorator.py:401
Method
is_bf16
(precision)
verl/utils/torch_dtypes.py:59
Method
is_fast
(self)
verl/workers/rollout/tokenizer.py:161
Method
is_fp16
(precision)
verl/utils/torch_dtypes.py:51
Method
is_fp32
(precision)
verl/utils/torch_dtypes.py:55
Function
is_sequence_parallel_param
(param)
verl/utils/megatron/sequence_parallel.py:25
Function
kl_penalty
Compute KL divergence given logprob and ref_logprob. Copied from https://github.com/huggingface/trl/blob/main/trl/trainer/ppo_trainer.py#L1104
verl/trainer/ppo/core_algos.py:279
Function
llama_flash_attn_forward
adapt from transformers 4.47.1
verl/models/transformers/llama.py:27
Method
load_checkpoint
(self, checkpoint_path)
verl/workers/megatron_workers.py:395
Method
load_checkpoint
(self, checkpoint_path)
verl/workers/megatron_workers.py:568
Function
load_fsdp_grad
(module, device_id)
verl/utils/fsdp_utils.py:86
Method
load_pretrained_model
(self, checkpoint_path)
verl/workers/megatron_workers.py:399
Function
load_state_dict_to_megatron_llama
Load merged state_dict to sharded Megatron module in training.
verl/models/llama/megatron/checkpoint_utils/llama_loader.py:51
Method
local_rank_list
(self)
verl/single_controller/base/worker_group.py:55
Method
local_world_size_list
(self)
verl/single_controller/base/worker_group.py:49
Method
log
(self, data, step)
verl/utils/tracking.py:67
Function
logprobs_of_labels_v2
A memory efficient implementation of logprobs_from_logits
verl/utils/torch_functional.py:76
Method
loss_func
(output, data, meta_info)
verl/workers/critic/megatron_critic.py:135
Method
loss_func
(output, data, meta_info)
verl/workers/actor/megatron_actor.py:249
Method
loss_func
(output)
verl/workers/reward_model/megatron/reward_model.py:219
Function
lr_lambda
(current_step)
verl/utils/torch_functional.py:412
Function
main_task
(config)
verl/trainer/main_ppo.py:109
Function
main_task
(config)
examples/split_placement/main_ppo_split.py:102
Method
make_minibatch_iterator
(self, data: DataProto)
verl/workers/critic/megatron_critic.py:106
Function
mark_parameter_as_sequence_parallel
(parameter)
verl/utils/megatron/sequence_parallel.py:21
Function
masked_sum
Compute mean of tensor with a masked values.
verl/utils/torch_functional.py:102
Function
masked_whiten
Whiten values with masked values.
verl/utils/torch_functional.py:130
Method
master_address
(self)
verl/single_controller/ray/base.py:354
Method
master_port
(self)
verl/single_controller/ray/base.py:358
Method
megatron_actor_model_provider
(pre_process, post_process)
tests/ray/detached_worker/server.py:93
Method
megatron_actor_model_provider
(pre_process, post_process)
verl/workers/megatron_workers.py:154
Method
megatron_critic_model_provider
(pre_process, post_process)
verl/workers/megatron_workers.py:476
Method
megatron_rm_model_provider
(pre_process, post_process)
verl/workers/megatron_workers.py:638
Method
memory_buffers
(self)
verl/utils/memory_buffer.py:213
Method
merge
(self, other)
verl/utils/seqlen_balancing.py:72
Function
merge_megatron_ckpt_llama
Merge sharded parameters of a Megatron module into a merged checkpoint. Args: wrapped_modelss (list of megatron.model.DistributedDataPara
verl/models/llama/megatron/checkpoint_utils/llama_saver.py:76
Function
meta_device_init
Create model parameters with meta device. Note buffers in model will still be initialized in default device (e.g., CPU), since the buffe
verl/utils/fsdp_utils.py:134
Function
num_tokens_from_string
(string)
eval_kk/kk_processor.py:6
Function
pad_packed_inputs
pad the tokens such that the total length is a multiple of size. This function is useful when applying sequence parallel and context parallel
verl/utils/model.py:299
Method
pad_token_id
`Optional[int]`: Id of the padding token in the vocabulary. Returns `None` if the token has not been set.
verl/workers/rollout/tokenizer.py:36
Function
parallel_init_module_fn
Generate a function to initialize sub-modules in the `module` with `shard_states` from huggingface checkpoint. Args: module (tor
verl/utils/fsdp_utils.py:221
Function
parallel_load_safetensors
Parallel load safetensors from huggingface checkpoint Huggingface checkpoint contains: - config.json: a json file for model configurati
verl/utils/fsdp_utils.py:165
Function
post_process_logits
(input_ids, logits, temperature, top_k, top_p)
verl/utils/torch_functional.py:359
Method
postprocess_data
(self, data: DataProto)
verl/workers/sharding_manager/fsdp_vllm.py:121
Method
postprocess_data
Split the data to follow FSDP partition
verl/workers/sharding_manager/fsdp_ulysses.py:80
Method
postprocess_data
(self, data: DataProto)
verl/workers/sharding_manager/megatron_vllm.py:394
Method
pp_group
(self)
verl/workers/sharding_manager/megatron_vllm.py:203
Method
pp_models
(self)
verl/workers/sharding_manager/megatron_vllm.py:207
Method
pp_rank
(self)
verl/workers/sharding_manager/megatron_vllm.py:199
Method
pp_size
(self)
verl/single_controller/base/megatron/worker_group.py:46
Method
pp_size
(self)
verl/workers/sharding_manager/megatron_vllm.py:195
Function
prepare_decoder_attention_mask
(attention_mask, input_shape, inputs_embeds)
verl/utils/torch_functional.py:434
Method
preprocess_data
(self, data: DataProto)
verl/workers/sharding_manager/fsdp_vllm.py:112
Method
preprocess_data
(self, data: DataProto)
verl/workers/sharding_manager/megatron_vllm.py:378
Method
print_size
(self, prefix="")
verl/protocol.py:225
Function
process
(iter)
verl/utils/debug/trajectory_tracker.py:94
Function
process_fn
(doc, idx)
examples/data_preprocess/hellaswag.py:55
Function
process_fn
(example, idx)
examples/data_preprocess/countdown.py:95
Function
process_fn
(example, idx)
examples/data_preprocess/kk.py:47
Function
process_fn
(example, idx)
examples/data_preprocess/full_hh_rlhf.py:95
Function
process_fn
(example, idx)
examples/data_preprocess/gsm8k.py:54
Function
process_fn
(example, idx)
examples/data_preprocess/multiply.py:100
Function
process_fn
(example, idx)
examples/data_preprocess/arth.py:111
Function
process_fn
(example, idx)
examples/data_preprocess/math_dataset.py:50
Method
prompt_length
(self)
tests/e2e/envs/digit_completion/task.py:69
Function
put_data
(index, data)
verl/utils/ray_utils.py:25
Function
qwen2_flash_attn_forward
( self, hidden_states: torch.Tensor, attention_mask: Optional[torch.Tensor] = None,
verl/models/transformers/qwen2.py:28
Function
register
(dispatch_mode=Dispatch.ALL_TO_ALL, execute_mode=Execute.ALL, blocking=True, materialize_futures=True)
verl/single_controller/base/decorator.py:394
Function
register_empty_parameter
(module, name, param)
verl/utils/fsdp_utils.py:146
Function
remote_call_wg
(worker_names)
tests/ray/test_worker_group_basics.py:69
Function
remove_pad_token
Remove the pad token. Args: input_ids shape: [bs, seq_length] attention_mask shape: [bs, seq_length] Returns: no_pa
verl/utils/torch_functional.py:269
Method
rename
Note that this function only rename the key in the batch
verl/protocol.py:397
Method
response_length
(self)
tests/e2e/envs/digit_completion/task.py:73
Method
sample_batch_str_prompts
(self, batch_size)
tests/e2e/envs/digit_completion/task.py:100
Method
save_checkpoint
(self, checkpoint_path)
verl/workers/megatron_workers.py:403
Method
save_checkpoint
(self, checkpoint_path)
verl/workers/megatron_workers.py:572
Method
save_checkpoint
(self, local_path, hdfs_path=None)
verl/workers/fsdp_workers.py:478
Function
save_to_hdfs
(data: io.BytesIO, name, hdfs_dir, verbose)
verl/utils/debug/trajectory_tracker.py:33
Method
series_to_item
(ls)
verl/utils/dataset/sft_dataset.py:75
Method
set_additional_resource
(self, additional_resource)
verl/single_controller/ray/base.py:136
Method
set_input_tensor
Set input tensor to be used instead of forward()'s input. When doing pipeline parallelism the input from the previous stage comes fro
verl/models/llama/megatron/modeling_llama_megatron.py:531
Method
set_state
(self, state)
tests/e2e/envs/digit_completion/task.py:64
Method
spread
(self)
verl/utils/seqlen_balancing.py:60
Function
squeeze
(x)
verl/utils/model.py:38
Method
store
(self)
verl/single_controller/base/worker_group.py:46
Method
supported_type
(precision: Union[str, int])
verl/utils/torch_dtypes.py:43
Method
supported_types
()
verl/utils/torch_dtypes.py:47
Function
test
()
tests/ray/test_high_level_scheduling_api.py:33
Function
test
()
tests/ray/test_driverfunc_to_worker.py:55
← previous
next →
701–800 of 858, ranked by callers