Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/Fugaku-LLM/DeepSpeedFugaku
/ functions
Functions
1,158 in github.com/Fugaku-LLM/DeepSpeedFugaku
⨍
Functions
1,158
◇
Types & classes
129
↓ 1 callers
Function
_add_distributed_args
(parser: argparse.ArgumentParser)
megatron/arguments.py:663
↓ 1 callers
Function
_add_gpt_fugaku_args
(parser: argparse.ArgumentParser)
megatron/arguments.py:970
↓ 1 callers
Function
_add_initialization_args
(parser: argparse.ArgumentParser)
megatron/arguments.py:531
↓ 1 callers
Function
_add_learning_rate_args
(parser: argparse.ArgumentParser)
megatron/arguments.py:546
↓ 1 callers
Function
_add_logging_args
(parser: argparse.ArgumentParser)
megatron/arguments.py:356
↓ 1 callers
Function
_add_memoryopt_args
Memory optimization arguments.
megatron/arguments.py:902
↓ 1 callers
Function
_add_mixed_precision_args
(parser: argparse.ArgumentParser)
megatron/arguments.py:625
↓ 1 callers
Function
_add_network_size_args
(parser: argparse.ArgumentParser)
megatron/arguments.py:305
↓ 1 callers
Function
_add_regularization_args
(parser: argparse.ArgumentParser)
megatron/arguments.py:393
↓ 1 callers
Function
_add_training_args
(parser: argparse.ArgumentParser)
megatron/arguments.py:419
↓ 1 callers
Function
_add_validation_args
(parser: argparse.ArgumentParser)
megatron/arguments.py:710
↓ 1 callers
Function
_add_vit_args
(parser: argparse.ArgumentParser)
megatron/arguments.py:870
↓ 1 callers
Function
_add_zero_args
Text generate arguments.
megatron/arguments.py:885
↓ 1 callers
Method
_all_gather
(self, param_list, async_op=False, hierarchy=None)
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:1000
↓ 1 callers
Method
_allgather_param
(self, param, async_op=False, hierarchy=0)
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:1177
↓ 1 callers
Method
_allgather_params
(self, param_list, hierarchy=0)
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:1305
↓ 1 callers
Method
_allgather_params_coalesced
blocking call avoid explicit memory copy in _allgather_params
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:1236
↓ 1 callers
Function
_build_doc_idx
Build an array with length = number-of-epochs * number-of-dcuments. Each index is mapped to a corresponding document.
megatron/data/gpt_dataset.py:410
↓ 1 callers
Method
_build_global_state
(self)
tools/convert_checkpoint/deepspeed_checkpoint.py:68
↓ 1 callers
Function
_build_index_mappings
Build doc-idx, sample-idx, and shuffle-idx. doc-idx: is an array (ordered) of documents to be used in training. sample-idx: is the start docum
megatron/data/gpt_dataset.py:232
↓ 1 callers
Function
_build_infinite_size_dataloader
Build a looped dataloader with infinite size.
tasks/vision/finetune_utils.py:91
↓ 1 callers
Function
_build_key_size_numel_dictionaries
Build the size on rank 0 and broadcast.
megatron/mpu/data.py:37
↓ 1 callers
Function
_build_lambada_dataset
Build lambada dataset.
tasks/zeroshot_gpt/datasets.py:129
↓ 1 callers
Function
_build_num_microbatches_calculator
(args: argparse.Namespace)
megatron/global_vars.py:128
↓ 1 callers
Method
_build_pp_transformer_map
(self)
tools/convert_checkpoint/deepspeed_checkpoint.py:116
↓ 1 callers
Function
_build_shuffle_idx
Build the range [0, size) and shuffle.
megatron/data/gpt_dataset.py:475
↓ 1 callers
Function
_build_train_valid_dataloaders
Traing and validation dataloaders.
tasks/vision/finetune_utils.py:102
↓ 1 callers
Method
_build_transformer_file_map
(self)
tools/convert_checkpoint/deepspeed_checkpoint.py:129
↓ 1 callers
Function
_build_wikitext103_dataset
()
tasks/zeroshot_gpt/datasets.py:142
↓ 1 callers
Function
_check_arg_is_not_none
(args, arg)
megatron/arguments.py:301
↓ 1 callers
Function
_check_data_types
Check that all the keys have the same target data type.
megatron/mpu/data.py:30
↓ 1 callers
Method
_checkpointed_forward
Forward method with activation checkpointing.
megatron/model/transformer.py:778
↓ 1 callers
Method
_clean_text
Performs invalid character removal and whitespace cleanup on text.
megatron/tokenizer/bert_tokenization.py:289
↓ 1 callers
Function
_convert_ds_transformer_state
(sd_list)
tools/convert_checkpoint/deepspeed_to_megatron.py:33
↓ 1 callers
Method
_copy_main_params_to_model_params
(self)
megatron/optimizer/optimizer.py:370
↓ 1 callers
Method
_copy_model_grads_to_main_grads
(self)
megatron/optimizer/optimizer.py:315
↓ 1 callers
Method
_copy_model_params_to_main_params
(self)
megatron/optimizer/optimizer.py:377
↓ 1 callers
Function
_create_build_dir
(buildpath)
megatron/fused_kernels/__init__.py:125
↓ 1 callers
Function
_create_checkpoint_paths
(base_folder, iteration, tp_degree, pp_degree)
tools/convert_checkpoint/deepspeed_to_megatron.py:42
↓ 1 callers
Function
_create_latest_file
(base_folder, iteration)
tools/convert_checkpoint/deepspeed_to_megatron.py:128
↓ 1 callers
Function
_create_megatron_dict
()
tools/convert_checkpoint/deepspeed_to_megatron.py:55
↓ 1 callers
Function
_disable_class
(cls)
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:445
↓ 1 callers
Function
_get_cuda_bare_metal_version
(cuda_dir)
megatron/fused_kernels/__init__.py:113
↓ 1 callers
Method
_get_files
(self, dir)
tools/convert_checkpoint/deepspeed_checkpoint.py:166
↓ 1 callers
Method
_get_layer_keys
(self)
tools/convert_checkpoint/deepspeed_checkpoint.py:173
↓ 1 callers
Function
_get_params_for_weight_decay_optimization
Divide params into with-weight-decay and without-weight-decay groups. Layernorms and baises will have no weight decay but the rest will.
megatron/optimizer/__init__.py:33
↓ 1 callers
Method
_get_pointers
Return a numpy array of byte offsets given a list of sizes. Multiplies values in the sizes array by dtype size (bytes),
megatron/data/indexed_dataset.py:392
↓ 1 callers
Function
_init_autoresume
Set autoresume start time.
megatron/initialize.py:244
↓ 1 callers
Function
_init_external_params
(module)
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:70
↓ 1 callers
Function
_initialize_distributed
Initialize torch.distributed and mpu.
megatron/initialize.py:192
↓ 1 callers
Function
_initialize_mem_buffs
Initialize manually allocated static memory.
megatron/initialize.py:281
↓ 1 callers
Method
_is_chinese_char
Checks whether CP is the codepoint of a CJK character.
megatron/tokenizer/bert_tokenization.py:267
↓ 1 callers
Function
_is_control
Checks whether `chars` is a control character.
megatron/tokenizer/bert_tokenization.py:377
↓ 1 callers
Function
_is_punctuation
Checks whether `chars` is a punctuation character.
megatron/tokenizer/bert_tokenization.py:389
↓ 1 callers
Function
_is_whitespace
Checks whether `chars` is a whitespace character.
megatron/tokenizer/bert_tokenization.py:365
↓ 1 callers
Method
_make_param_hook
Create the all-reduce hook for backprop.
megatron/model/distributed.py:168
↓ 1 callers
Function
_num_epochs
Based on number of samples and sequence lenght, calculate how many epochs will be needed.
megatron/data/gpt_dataset.py:395
↓ 1 callers
Function
_num_tokens
Total number of tokens in the dataset.
megatron/data/gpt_dataset.py:390
↓ 1 callers
Function
_parse_args
Parse entire arguments.
megatron/global_vars.py:114
↓ 1 callers
Method
_partition
(self, param_list, force=False, has_been_updated=False)
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:1030
↓ 1 callers
Method
_partition_gradient
(self, param, partition_buffer=None, accumulate=False)
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:1447
↓ 1 callers
Method
_partition_gradients
(self, param_list, partition_buffers=None, accumulate=False)
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:1438
↓ 1 callers
Method
_partition_numel
(self, param)
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:981
↓ 1 callers
Method
_partition_param
(self, param, buffer=None, has_been_updated=False)
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:1043
↓ 1 callers
Method
_post_init_method
(self, module)
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:421
↓ 1 callers
Function
_print_args
Print arguments.
megatron/arguments.py:286
↓ 1 callers
Method
_reduce_scatter_gradient
(self, param)
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:1398
↓ 1 callers
Method
_reduce_scatter_gradients
(self, param_list)
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:1367
↓ 1 callers
Function
_renest_sd
(sd)
tools/convert_checkpoint/deepspeed_to_megatron.py:73
↓ 1 callers
Method
_run_split_on_punc
Splits punctuation on a piece of text.
megatron/tokenizer/bert_tokenization.py:234
↓ 1 callers
Method
_run_strip_accents
Strips accents from a piece of text.
megatron/tokenizer/bert_tokenization.py:223
↓ 1 callers
Method
_sanity_check
(self)
tools/convert_checkpoint/deepspeed_checkpoint.py:145
↓ 1 callers
Function
_save_checkpoint
(file_path, chkpt_sd)
tools/convert_checkpoint/deepspeed_to_megatron.py:67
↓ 1 callers
Function
_set_adlr_autoresume
Initialize ADLR autoresume.
megatron/global_vars.py:216
↓ 1 callers
Method
_set_dtype
(self, ds_config, dtype)
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:424
↓ 1 callers
Function
_set_random_seed
Set random seed for reproducability.
megatron/initialize.py:253
↓ 1 callers
Function
_set_tensorboard_writer
Set tensorboard writer.
megatron/global_vars.py:151
↓ 1 callers
Function
_set_timers
Initialize timers.
megatron/global_vars.py:234
↓ 1 callers
Function
_set_wandb_writer
Set wandb writer.
megatron/global_vars.py:177
↓ 1 callers
Method
_tokenize_chinese_chars
Adds whitespace around any CJK character.
megatron/tokenizer/bert_tokenization.py:254
↓ 1 callers
Function
_train
Train the model.
tasks/vision/finetune_utils.py:124
↓ 1 callers
Method
_unscale_main_grads_and_check_for_nan
(self)
megatron/optimizer/optimizer.py:332
↓ 1 callers
Method
_validate_remote_device
(self, remote_device, ds_config)
DeepSpeed/deepspeed/runtime/zero/partition_parameters.py:720
↓ 1 callers
Function
_vocab_size_with_padding
Pad vocab size so it is divisible by model parallel size and still having GPU friendly size.
megatron/tokenizer/tokenizer.py:60
↓ 1 callers
Function
accuracy_func_provider
Provide function that calculates accuracies.
tasks/vision/eval_utils.py:28
↓ 1 callers
Method
add_additional_special_tokens
(self, tokens_list)
megatron/tokenizer/tokenizer.py:175
↓ 1 callers
Method
add_block_data
Add data for set of blocks :param row_id: 1D array of unique int ids for the blocks :param block_embeds: 2D array of embeddin
megatron/data/realm_index.py:61
↓ 1 callers
Method
add_embed_data
Add the embedding of each block to the underlying FAISS index
megatron/data/realm_index.py:186
↓ 1 callers
Method
add_item
(self, tensor)
megatron/data/indexed_dataset.py:289
↓ 1 callers
Method
allreduce_gradients
Reduce gradients across data parallel ranks.
megatron/model/distributed.py:188
↓ 1 callers
Method
as_array
(self)
megatron/data/realm_dataset_utils.py:88
↓ 1 callers
Method
as_tuple
(self)
megatron/data/realm_dataset_utils.py:91
↓ 1 callers
Function
attn_mask_postprocess
(attn_mask)
megatron/model/t5_model.py:38
↓ 1 callers
Method
backward
(ctx, output_grads)
megatron/model/fused_softmax.py:73
↓ 1 callers
Function
bias_gelu
(bias, y)
megatron/model/fused_bias_gelu.py:37
↓ 1 callers
Function
bias_gelu_back
(g, bias, y)
megatron/model/fused_bias_gelu.py:45
↓ 1 callers
Method
bpe
(self, token)
megatron/tokenizer/gpt2_tokenization.py:195
↓ 1 callers
Method
build_and_save_index
Goes through one epoch of the dataloader and adds all data to this instance's BlockData. The copy of BlockData is saved as a
megatron/indexer.py:77
↓ 1 callers
Function
build_dataset
Helper function to select and build dataset.
tasks/zeroshot_gpt/datasets.py:30
↓ 1 callers
Function
build_num_microbatches_calculator
( args: argparse.Namespace, )
megatron/microbatches.py:26
← previous
next →
301–400 of 1,158, ranked by callers