MCPcopy Create free account

hub / github.com/deepspeedai/DeepSpeed / functions

Functions10,922 in github.com/deepspeedai/DeepSpeed

↓ 2 callersFunctionfind_sym_seq_node
Return the SymInt placeholder node for the sequence-length dimension of input_ids, or None if it cannot be found.
tests/unit/v1/compile/util.py:285
↓ 2 callersMethodfit
(self, xs, ys)
deepspeed/autotuning/tuner/cost_model.py:51
↓ 2 callersFunctionflatten_inference_model
Flatten the underlying parameters into Arguments: transformer_containers: Iterable of layer containers corresponding to the transfor
deepspeed/inference/v2/model_implementations/flat_model_helpers.py:100
↓ 2 callersFunctionflops_to_string
(flops, units=None, precision=DEFAULT_PRECISION)
deepspeed/profiling/flops_profiler/profiler.py:1161
↓ 2 callersMethodforward
(self, x, y)
tests/unit/simple_model.py:30
↓ 2 callersMethodforward
x: the activation that we need to quantize num_bits: the number of bits we need to quantize the activation to *args: some ext
deepspeed/compression/basic_layer.py:40
↓ 2 callersMethodfp16_master_weights_and_gradients
(self)
deepspeed/runtime/engine.py:1249
↓ 2 callersMethodfrom_str
(cls, value: str)
deepspeed/inference/config.py:22
↓ 2 callersMethodfuse_lora_weight
(self)
deepspeed/runtime/hybrid_engine.py:135
↓ 2 callersFunctiongather
(tensor, gather_list=None, dst=0, group=None, async_op=False,
deepspeed/comm/comm.py:397
↓ 2 callersFunctiongather_opt_state
(optimizer_state)
tests/unit/checkpoint/test_universal_checkpoint.py:38
↓ 2 callersMethodgather_params
Gather partitioned parameters back to full size.
deepspeed/module_inject/layers.py:1261
↓ 2 callersFunctiongather_partitioned_activations
(tensors, device=None)
deepspeed/runtime/activation_checkpointing/checkpointing.py:266
↓ 2 callersMethodgb_size
(self)
deepspeed/runtime/checkpoint_engine/decoupled_checkpoint_engine.py:31
↓ 2 callersFunctiongelu_functor
(x)
deepspeed/ops/transformer/inference/triton/gelu.py:13
↓ 2 callersMethodgen_cpu_optimizer_flag
(self, test_config, is_baseline)
tests/model/Megatron_GPT2/run_func_test.py:550
↓ 2 callersMethodgenerate
Run generation, return prompt+response in one tensor.
deepspeed/runtime/rollout/base.py:94
↓ 2 callersFunctiongenerate_main
(log_dir)
deepspeed/nvme/perf_generate_param.py:86
↓ 2 callersFunctiongenerate_permute_indices
Prepare permutation indices and aligned token counts per expert. Args: tokens_per_expert_group: Token counts for each expert from all ran
deepspeed/moe/ep_kernels.py:193
↓ 2 callersMethodgetOffset
csrc/includes/deepcompile.h:301
↓ 2 callersMethodgetShape
csrc/includes/deepcompile.h:275
↓ 2 callersMethodget_2d_parallel_files
(self, tp_index: int, pp_index: int)
deepspeed/checkpoint/deepspeed_checkpoint.py:220
↓ 2 callersFunctionget_active_z3_eager_fallback
()
deepspeed/compile/z3_eager_fallback.py:16
↓ 2 callersMethodget_additional_losses
(self)
deepspeed/runtime/pipe/engine.py:1396
↓ 2 callersFunctionget_all_comm_dtypes
(params: Iterable)
deepspeed/runtime/torch_autocast.py:85
↓ 2 callersMethodget_all_grad_tensors
(self, tensor_list, dtype)
deepspeed/runtime/zero/stage_1_and_2.py:2031
↓ 2 callersFunctionget_annotations_from_namespace
(namespace: Mapping[str, object])
deepspeed/compat.py:23
↓ 2 callersFunctionget_autocast_dtype
()
deepspeed/runtime/torch_autocast.py:73
↓ 2 callersMethodget_backend
(self, group=None)
deepspeed/comm/torch.py:400
↓ 2 callersMethodget_best_space_record
(self, space_name)
deepspeed/autotuning/autotuner.py:714
↓ 2 callersMethodget_best_space_records
(self)
deepspeed/autotuning/autotuner.py:728
↓ 2 callersFunctionget_bfloat16_config
(param_dict)
deepspeed/runtime/precision_config.py:34
↓ 2 callersMethodget_block_size
csrc/aio/py_lib/deepspeed_py_io_handle.cpp:65
↓ 2 callersFunctionget_checkpoint_files
(checkpoint_dir, glob_pattern)
deepspeed/utils/zero_to_fp32.py:86
↓ 2 callersFunctionget_checkpoint_folder_size
(save_dir, tag, local_rank=None)
deepspeed/runtime/utils.py:1074
↓ 2 callersMethodget_checkpoint_version
(self, state_dict)
deepspeed/runtime/state_dict_factory.py:425
↓ 2 callersMethodget_cmd
(self, environment, active_resources)
deepspeed/launcher/multinode_runner.py:358
↓ 2 callersFunctionget_compress_methods
(model, compress_methods, mpu=None)
deepspeed/compression/compress.py:50
↓ 2 callersMethodget_compute_tensors
(self)
deepspeed/runtime/swap_tensor/utils.py:81
↓ 2 callersFunctionget_config_default
(config, field_name)
deepspeed/runtime/config_utils.py:120
↓ 2 callersFunctionget_config_dict
(zero_stage)
tests/unit/v1/zero/test_zero_hook_count_regression.py:23
↓ 2 callersMethodget_config_dict
(self, stage, offload_selective_optimizer, select_strategy, select_interval, update_interval,
tests/unit/runtime/zenflow/test_zf.py:20
↓ 2 callersFunctionget_cpu_activations_for_backward
(args, inputs)
deepspeed/runtime/activation_checkpointing/checkpointing.py:474
↓ 2 callersMethodget_cuda_lib64_path
(self)
op_builder/builder.py:899
↓ 2 callersFunctionget_current_queue
csrc/xpu/packbits/packing.cpp:31
↓ 2 callersFunctionget_data_efficiency_enabled
(param_dict)
deepspeed/runtime/data_pipeline/config.py:26
↓ 2 callersFunctionget_data_parallel_group
Get the data parallel group the caller rank belongs to.
deepspeed/utils/groups.py:190
↓ 2 callersMethodget_data_parallel_group
(self)
tests/unit/model_parallelism/test_autotp_training.py:115
↓ 2 callersMethodget_data_parallel_group_ranks
List of ranks in the data parallel group.
deepspeed/runtime/pipe/topology.py:440
↓ 2 callersMethodget_data_parallel_world_size
(self)
tests/unit/model_parallelism/test_autotp_training.py:112
↓ 2 callersFunctionget_default_args
(func)
deepspeed/comm/utils.py:59
↓ 2 callersFunctionget_default_compute_capabilities
()
op_builder/builder.py:62
↓ 2 callersFunctionget_dist_msg
(message, ranks=None)
deepspeed/utils/logging.py:86
↓ 2 callersMethodget_ds_config
(self)
tests/unit/compression/test_compression.py:104
↓ 2 callersFunctionget_env_if_set
Returns an environment variable if it is set and not "", otherwise returns a default value. In contrast, the fallback parameter of os.env
setup.py:72
↓ 2 callersMethodget_ep_ranks
(self, rank=0, group_name=None)
deepspeed/runtime/zero/stage_1_and_2.py:2641
↓ 2 callersMethodget_files_for_rank
(self, pp_index, tp_index, dp_index)
deepspeed/checkpoint/zero_checkpoint.py:49
↓ 2 callersFunctionget_first_config
(config: dict)
deepspeed/autotuning/utils.py:387
↓ 2 callersMethodget_fp32_grad_partitions
get fp32 gradient partition dictionary accessed as grad_dict[parameter_group_index][parameter_index]
deepspeed/runtime/zero/stage3.py:2744
↓ 2 callersMethodget_full_hp_param
(self, param, optim_state_key=None)
deepspeed/runtime/zero/stage3.py:2844
↓ 2 callersMethodget_gpu_chunk
(self)
deepspeed/sequence/fpdt_layer.py:525
↓ 2 callersFunctionget_grad
(param, zero_stage)
tests/unit/ulysses_alst/test_ulysses_sp_hf.py:23
↓ 2 callersFunctionget_grad
(param, zero_stage)
tests/unit/ulysses_alst/test_tiled_compute.py:19
↓ 2 callersMethodget_graph_order
(self)
deepspeed/compile/backend.py:61
↓ 2 callersFunctionget_group
(gid: int)
deepspeed/compile/custom_ops/sp_dp_registry.py:18
↓ 2 callersMethodget_handle
deepspeed/inference/v2/kernels/core_ops/blas_kernels/blas_utils.h:50
↓ 2 callersMethodget_hidden_heads
(self)
deepspeed/module_inject/containers/opt.py:127
↓ 2 callersMethodget_instantiation_memory_required_per_gpu
(self, zero_stage)
deepspeed/autotuning/autotuner.py:278
↓ 2 callersMethodget_intra_op_parallelism
csrc/aio/py_lib/deepspeed_py_io_handle.cpp:79
↓ 2 callersFunctionget_kv_block_size
Return preferred granulatity for blocked KV-cache implementation.
deepspeed/inference/v2/kernels/ragged_ops/blocked_flash/blocked_flash.py:45
↓ 2 callersMethodget_local_fp32_param
(self, param, optim_state_key=None)
deepspeed/runtime/zero/stage3.py:2912
↓ 2 callersFunctionget_log_level_from_string
converts a log level string into its numerical equivalent. e.g. "info" => `logging.INFO`
deepspeed/utils/logging.py:183
↓ 2 callersMethodget_lora_matched_pair
Get the pair of lora params and its matched model parameters.
deepspeed/module_inject/containers/features/hybrid_engine.py:59
↓ 2 callersMethodget_lp_grad_fragment
(self, index_in_param_group)
deepspeed/utils/tensor_fragment.py:60
↓ 2 callersMethodget_lr
(self)
deepspeed/runtime/lr_schedules.py:691
↓ 2 callersMethodget_lr
(self)
deepspeed/runtime/engine.py:3455
↓ 2 callersMethodget_model
(self, model_name)
tests/unit/hybrid_engine/test_he_llama.py:42
↓ 2 callersMethodget_model
(self, model_name)
tests/unit/hybrid_engine/test_he_lora.py:123
↓ 2 callersMethodget_model
(self, model_name)
tests/unit/hybrid_engine/test_he_all.py:41
↓ 2 callersFunctionget_model_ckpt_name_for_rank
(base_folder, mp_rank_str)
deepspeed/checkpoint/utils.py:11
↓ 2 callersMethodget_model_num_params
(self)
deepspeed/autotuning/autotuner.py:659
↓ 2 callersMethodget_model_parallel_rank
(self)
deepspeed/runtime/pipe/topology.py:446
↓ 2 callersFunctionget_module_flops
(module)
deepspeed/profiling/flops_profiler/profiler.py:1180
↓ 2 callersFunctionget_module_name
get the associated module name from the model based on the key_word provided by users
deepspeed/compression/compress.py:30
↓ 2 callersMethodget_mom
Calculates the momentum at batch index. This function treats `self.last_batch_iteration` as the last batch index.
deepspeed/runtime/lr_schedules.py:596
↓ 2 callersFunctionget_n_embd
()
deepspeed/module_inject/tp_shard.py:70
↓ 2 callersMethodget_name
(self)
tests/unit/compile/test_list_schedule.py:389
↓ 2 callersFunctionget_new_runnable_nodes_with
(scheduled: List[Node], edges: Dict[Node, List[Node]], new_scheduled: Node)
deepspeed/compile/list_schedule.py:122
↓ 2 callersFunctionget_norm_with_moe_layers
Compute the global norm with MoE experts Inputs: non_expert_norm (float) : the calculated norm of the non-expert params expert_tensors (
deepspeed/runtime/utils.py:1110
↓ 2 callersFunctionget_numa_cores
()
deepspeed/utils/numa.py:24
↓ 2 callersFunctionget_numactl_cmd
(bind_core_list, num_local_procs, local_rank)
deepspeed/utils/numa.py:104
↓ 2 callersFunctionget_only_unique_item
(items)
deepspeed/runtime/utils.py:861
↓ 2 callersFunctionget_optim_files
(checkpoint_dir)
deepspeed/utils/zero_to_fp32.py:96
↓ 2 callersFunctionget_optimizer_name
(param_dict)
deepspeed/runtime/config.py:429
↓ 2 callersFunctionget_optimizer_params
(param_dict)
deepspeed/runtime/config.py:436
↓ 2 callersMethodget_or_create_sequence
Get the existing sequence descriptor for a given uid or initialize one if it does not exist. NOTE: This will always return a valid se
deepspeed/inference/v2/ragged/ragged_manager.py:132
↓ 2 callersMethodget_overlap_events
csrc/aio/py_lib/deepspeed_py_io_handle.cpp:77
↓ 2 callersFunctionget_param_nodes
(graph: Graph, index_to_ds_ids: List[Tuple[int, int]])
deepspeed/compile/util.py:139
↓ 2 callersMethodget_partition_config_object
Get the AutoTPConfig object from the configuration. Returns None if no custom config is specified.
deepspeed/runtime/tensor_parallel/config.py:115
↓ 2 callersFunctionget_partitioned_activations_for_backward
(args, inputs, contiguous_checkpoint)
deepspeed/runtime/activation_checkpointing/checkpointing.py:432
← previousnext →1,601–1,700 of 10,922, ranked by callers