MCPcopy Create free account

hub / github.com/deepspeedai/DeepSpeed / functions

Functions11,258 in github.com/deepspeedai/DeepSpeed

↓ 847 callersFunctionget_accelerator
()
accelerator/real_accelerator.py:51
↓ 669 callersMethodappend
(self, raw_name, record_name, latency, msg_size)
deepspeed/utils/comms_logging.py:104
↓ 447 callersMethodto
(self, *args, **kwargs)
deepspeed/ops/fp_quantizer/quantize.py:100
↓ 357 callersMethodparameters
This method should create a generator of tuples of the form (name, parameter) for all parameters in the model. The name should be the
deepspeed/inference/v2/checkpoint/base_engine.py:28
↓ 344 callersMethodinitialize
Create the inference parameter.
deepspeed/inference/v2/inference_parameter.py:56
↓ 340 callersMethodnumel
(self)
deepspeed/runtime/swap_tensor/optimizer_utils.py:60
↓ 242 callersMethodbackward
(ctx, grad_output)
tests/unit/v1/zero/test_zero_activation_checkpoint_lifecycle.py:68
↓ 227 callersMethoddevice_name
(self, device_index=None)
accelerator/hpu_accelerator.py:56
↓ 212 callersMethodget_world_size
(self, group=None)
deepspeed/comm/torch.py:394
↓ 204 callersMethodcopy_
(self, other)
tests/unit/v1/zero/test_overlap_comm_record_stream.py:19
↓ 202 callersMethodget_rank
(self, group=None)
deepspeed/comm/torch.py:391
↓ 187 callersMethodstep
(self, closure=None)
tests/unit/runtime/sparse_tensor/test_sparse_grads.py:36
↓ 181 callersMethodget
Retrieve and materialize stored real inputs Returns: Materialized real inputs with actual tensors Raises:
deepspeed/compile/input_storage.py:165
↓ 170 callersMethodreshape
(self, target_3d_desc, verbose=False)
deepspeed/checkpoint/reshape_3d_utils.py:24
↓ 157 callersMethodcontiguous
Merge partitioned weights from flat_groups into a single tensor.
deepspeed/utils/zero_to_fp32.py:435
↓ 148 callersMethodget_rank
Return the global rank of a process via its coordinates. Coordinates are specified as kwargs. For example: >>> X = ProcessTopolo
deepspeed/runtime/pipe/topology.py:49
↓ 131 callersFunctionrandom_dataloader
(model, total_samples, hidden_dim, device, dtype=preferred_dtype())
tests/unit/simple_model.py:275
↓ 130 callersMethodis_fp16_supported
(self)
accelerator/hpu_accelerator.py:163
↓ 126 callersMethodmanual_seed
(self, seed)
accelerator/hpu_accelerator.py:88
↓ 125 callersMethodsize
(self, index)
deepspeed/runtime/data_pipeline/data_sampling/indexed_dataset.py:207
↓ 112 callersMethodwarning
(self, msg)
op_builder/builder.py:507
↓ 111 callersMethoddestroy
(self)
deepspeed/runtime/engine.py:826
↓ 108 callersMethodsize
csrc/adam/cpu_adam_impl.cpp:400
↓ 107 callersMethoddata_ptr
csrc/gds/py_lib/deepspeed_gds_op.cpp:109
↓ 91 callersMethodis_bf16_supported
(self)
accelerator/hpu_accelerator.py:160
↓ 88 callersMethodall_reduce
(self, tensor, op=ReduceOp.SUM, group=None, async_op=False)
deepspeed/comm/ccl.py:79
↓ 88 callersMethodbarrier
(self, group=None, async_op=False)
deepspeed/comm/ccl.py:137
↓ 88 callersMethodcurrent_device_name
(self)
accelerator/hpu_accelerator.py:69
↓ 83 callersMethodis_initialized
(self)
deepspeed/comm/ccl.py:60
↓ 82 callersMethoddevice
(self, device_index=None)
accelerator/hpu_accelerator.py:60
↓ 79 callersMethodget
Retrieves a single item from the dataset with the option to only return a portion of the item. get(idx) is the same as [idx] but get
deepspeed/runtime/data_pipeline/data_sampling/indexed_dataset.py:532
↓ 69 callersFunctionget_scalar_param
(param_dict, param_name, param_default_value)
deepspeed/runtime/config_utils.py:193
↓ 68 callersMethodadd
(self, b)
deepspeed/runtime/sparse_tensor.py:55
↓ 68 callersMethodcurrent_device_name
(self)
tests/unit/v1/zero/test_overlap_comm_record_stream.py:42
↓ 66 callersFunctionrequired_torch_version
(min_version=None, max_version=None)
deepspeed/utils/torch.py:16
↓ 64 callersMethodload
(self, verbose=False)
op_builder/builder.py:526
↓ 60 callersMethoddevice
(self)
deepspeed/runtime/swap_tensor/optimizer_utils.py:77
↓ 59 callersMethodapply
(self, module, enable_cuda_graph=True)
deepspeed/module_inject/containers/vae.py:36
↓ 59 callersMethodupdate
Update the tuner with what configurations have been evaluated and their performance results
deepspeed/autotuning/tuner/base_tuner.py:35
↓ 56 callersMethodstart
(self)
deepspeed/utils/timer.py:168
↓ 55 callersMethoddtype
(self)
deepspeed/runtime/swap_tensor/optimizer_utils.py:80
↓ 55 callersFunctionpreferred_dtype
()
tests/unit/common.py:512
↓ 54 callersMethodsynchronize
(self, device_index=None)
accelerator/hpu_accelerator.py:75
↓ 52 callersMethod_op
Return torch.ops.deepspeed.<name>, raising clearly if not registered.
op_builder/supa/inference.py:25
↓ 52 callersMethodcurrent_device
(self)
tests/unit/compile/test_list_schedule.py:286
↓ 51 callersMethodis_available
(self)
accelerator/hpu_accelerator.py:176
↓ 49 callersMethodtranspose
(self)
deepspeed/module_inject/containers/base.py:284
↓ 46 callersMethodcopy
(self, dst, src, int8=False, allocate_tensor=False)
deepspeed/module_inject/auto_tp.py:100
↓ 46 callersMethodexists
(path)
deepspeed/runtime/data_pipeline/data_sampling/indexed_dataset.py:211
↓ 46 callersMethodmean
(self)
deepspeed/utils/timer.py:180
↓ 46 callersFunctionsee_memory_usage
(message, force=False)
deepspeed/runtime/utils.py:815
↓ 45 callersMethodnew_group
(self, ranks)
deepspeed/comm/ccl.py:154
↓ 44 callersFunctiongetCurrentCUDAStream
csrc/xpu/adam/multi_tensor_apply.dp.hpp:23
↓ 42 callersMethodsave_checkpoint
Save training checkpoint Arguments: save_dir: Required. Directory for saving the checkpoint tag: Optional. Checkpoint
deepspeed/runtime/engine.py:4682
↓ 40 callersMethodbroadcast
(self, tensor, src, group=None, async_op=False)
deepspeed/comm/ccl.py:94
↓ 40 callersMethodstop
(self, **kwargs)
deepspeed/utils/timer.py:174
↓ 39 callersFunctioninitialize_distributed
()
tests/unit/v1/zero/test_zero_user_backward.py:100
↓ 39 callersFunctionlog_dist
Log message when get_dist_msg() deems it should be logged, see its docstring for details. Args: message (str) ranks (list)
deepspeed/utils/logging.py:113
↓ 38 callersMethodfull
(self, device=None)
deepspeed/runtime/utils.py:715
↓ 36 callersMethod__new__
(cls, *values)
deepspeed/runtime/config.py:111
↓ 36 callersMethodload
(self)
deepspeed/ops/transformer/inference/triton/matmul_ext.py:116
↓ 36 callersMethodmakedirs
(self, path, exist_ok=False)
deepspeed/runtime/checkpoint_engine/checkpoint_engine.py:35
↓ 35 callersFunctionallclose
(x, y, tolerances: Tuple[int, int] = None)
tests/unit/inference/v2/inference_test_utils.py:40
↓ 35 callersMethodcurrent_stream
(self, device_index=None)
accelerator/hpu_accelerator.py:108
↓ 34 callersMethodcommunication_backend_name
(self)
accelerator/hpu_accelerator.py:188
↓ 34 callersMethodlog
(self, names, normalizer=1.0, reset=True, memory_breakdown=False, ranks=None)
deepspeed/utils/timer.py:192
↓ 34 callersMethodread
(self, args, tid)
deepspeed/nvme/torch_io.py:23
↓ 33 callersMethodpin_memory
(self, tensor, align_bytes=1)
accelerator/hpu_accelerator.py:234
↓ 32 callersMethodall_gather
(self, tensor_list, tensor, group=None, async_op=False)
deepspeed/comm/ccl.py:97
↓ 32 callersMethodall_gather_into_tensor
(self, output_tensor, input_tensor, group=None, async_op=False)
deepspeed/comm/ccl.py:111
↓ 32 callersMethodcurrent_device
(self)
accelerator/hpu_accelerator.py:66
↓ 32 callersMethodfrom_pretrained
(*args, **kwargs)
deepspeed/linear/context_manager.py:68
↓ 32 callersMethodis_rocm_pytorch
()
op_builder/builder.py:185
↓ 32 callersMethodstate_dict
(self)
deepspeed/runtime/lr_schedules.py:658
↓ 31 callersMethodload
(module, state_dict, prefix)
deepspeed/inference/engine.py:308
↓ 30 callersMethodstream
(self, stream)
accelerator/hpu_accelerator.py:105
↓ 29 callersMethodall_gather
(param_list=None, async_op=False, hierarchy=0)
deepspeed/runtime/zero/partition_parameters.py:1278
↓ 29 callersMethodempty_cache
(self)
accelerator/hpu_accelerator.py:120
↓ 29 callersMethodload_checkpoint
Load training checkpoint Arguments: load_dir: Required. Directory to load the checkpoint from tag: Checkpoin
deepspeed/runtime/engine.py:4204
↓ 28 callersMethodload
(module, state_dict, prefix, mp_group=None)
deepspeed/module_inject/auto_tp.py:156
↓ 28 callersMethodsave
(self, name: str, v: Argument, offload)
deepspeed/compile/util.py:212
↓ 28 callersMethodwrite
(self, rel: str, content: str = "")
ci/test_tests_fetcher.py:90
↓ 27 callersMethodload
(self, name: str)
deepspeed/compile/util.py:215
↓ 26 callersMethodwait
(self)
deepspeed/comm/torch.py:94
↓ 24 callersFunctionhasKey
csrc/includes/deepcompile.h:33
↓ 24 callersMethodrecord
(self)
tests/unit/modeling.py:107
↓ 24 callersMethodzero_grad
(self)
deepspeed/ops/lion/fused_lion.py:47
↓ 23 callersFunction_config
(zero_stage, world_size=2, contiguous_gradients=False, overlap_comm=False,
tests/unit/v1/zero/test_zero_coalesce_grad_reduction.py:16
↓ 23 callersMethodadd
Track the rng state.
deepspeed/runtime/activation_checkpointing/checkpointing.py:154
↓ 23 callersFunctionbf16_required_version_check
(accelerator_check=True)
tests/unit/util.py:39
↓ 23 callersMethodclear
(self)
deepspeed/compile/backend.py:66
↓ 23 callersMethodget_param_id
(self, param)
deepspeed/runtime/zero/stage3.py:1439
↓ 23 callersMethodsizes
(self)
deepspeed/runtime/data_pipeline/data_sampling/indexed_dataset.py:546
↓ 23 callersMethodsupported_dtypes
(self)
accelerator/hpu_accelerator.py:169
↓ 22 callersMethoddecode
(self, *inputs, **kwargs)
deepspeed/model_implementations/diffusers/vae.py:56
↓ 22 callersFunctionget_caller_func
(frame=3)
deepspeed/utils/comms_logging.py:10
↓ 22 callersMethodrun
(self)
tests/unit/common.py:155
↓ 22 callersMethodwait
(self, **kwargs)
tests/unit/runtime/zero/test_zero_context.py:88
↓ 22 callersFunctionz3_leaf_module
Returns whether a module in `model` has been flagged as a 'leaf' module. See `set_z3_leaf_modules` for more details. Args:
deepspeed/utils/z3_leaf_module.py:15
↓ 21 callersMethodGetCurrentStream
csrc/transformer/inference/includes/inference_context.h:216
next →1–100 of 11,258, ranked by callers