MCPcopy Create free account

hub / github.com/deepspeedai/DeepSpeed / functions

Functions11,258 in github.com/deepspeedai/DeepSpeed

↓ 2 callersMethod_gradient_averaging_world_size
(self, params, partition_world_size)
deepspeed/runtime/zero/stage3.py:640
↓ 2 callersFunction_group_gemm
Forward-style grouped GEMM: a[M,KC] x b[E,KC,NO] -> out[M,NO], grouped over M.
deepspeed/moe/group_gemm_triton.py:314
↓ 2 callersMethod_group_step_offloaded
Per-parameter selective update for offloaded partitions (CPU or NVMe). NVMe partitions are swapped in, updated, and swapped back out one at a
deepspeed/ops/adam/zenflow_torch_adam.py:506
↓ 2 callersFunction_has_3d_expert_params
Check if module stores expert weights as 3D parameter tensors (transformers 5.0.0+). Returns True if the module has a parameter named preset.expe
deepspeed/module_inject/auto_ep.py:95
↓ 2 callersMethod_has_inf_or_nan
(x, j=None)
deepspeed/runtime/zero/stage3.py:2710
↓ 2 callersFunction_infer_subparam_logical_shapes
(weight_shape, shape, partition_dim, name=None)
deepspeed/module_inject/layers.py:1101
↓ 2 callersMethod_init
(self, log_level=None)
tests/unit/v1/test_engine_log_level.py:53
↓ 2 callersMethod_init
(self, gradient_clipping=None)
tests/unit/v1/half_precision/test_gradient_clipping_default.py:50
↓ 2 callersFunction_init_external_params
(module)
deepspeed/runtime/zero/partition_parameters.py:130
↓ 2 callersMethod_initialization_checker
Returns whether or not all parameters have been initialized and transformed by the model. Once this returns True, all the `ParameterB
deepspeed/inference/v2/model_implementations/layer_container_base.py:205
↓ 2 callersMethod_initialize_from_swapped_fp16_params
(self, aio_handle, fp16_partitions_info, fp16_num_elems, fp16_pin
deepspeed/runtime/swap_tensor/optimizer_utils.py:275
↓ 2 callersMethod_initialize_parameters
(self, parameters, src_tensors, aio_handle)
deepspeed/runtime/swap_tensor/optimizer_utils.py:374
↓ 2 callersMethod_invalidate_trace
(self)
deepspeed/runtime/zero/partitioned_param_coordinator.py:195
↓ 2 callersMethod_is_checkpointable
(self, funcs)
deepspeed/runtime/pipe/module.py:670
↓ 2 callersFunction_is_even
(x)
deepspeed/runtime/pipe/schedule.py:489
↓ 2 callersFunction_is_expert_model_state_file
(checkpoint_file)
deepspeed/checkpoint/ds_to_universal.py:777
↓ 2 callersMethod_is_ongoing_drain
(self)
deepspeed/io/double_io_buffer.py:83
↓ 2 callersMethod_is_test_file
(self, path: Path)
ci/tests_fetcher.py:254
↓ 2 callersFunction_is_valid_send_recv
(src_stage, dest_stage)
deepspeed/runtime/pipe/p2p.py:37
↓ 2 callersFunction_key_list_to_string
(key_list)
deepspeed/checkpoint/reshape_utils.py:76
↓ 2 callersMethod_largest_contiguous
(self)
deepspeed/runtime/zero/contiguous_memory_allocator.py:274
↓ 2 callersMethod_launch_daemonic_procs
(self, num_procs, init_method)
tests/unit/common.py:180
↓ 2 callersMethod_launch_with_file_store
(self, request, world_size)
tests/unit/common.py:342
↓ 2 callersMethod_lazy_init_class_dict
(self)
accelerator/hpu_accelerator.py:261
↓ 2 callersMethod_lazy_init_class_dict
(self)
accelerator/supa_accelerator.py:240
↓ 2 callersMethod_lazy_init_class_dict
(self)
accelerator/cuda_accelerator.py:356
↓ 2 callersMethod_link_all_hp_params
(self)
deepspeed/runtime/bf16_optimizer.py:258
↓ 2 callersFunction_llama3_inverse_frequencies
(config: Any, device: Any)
deepspeed/inference/v2/model_implementations/exaone4_5/model.py:34
↓ 2 callersFunction_load_torch_checkpoint
(path)
tests/unit/v1/moe/test_autoep_autotp_checkpoint.py:212
↓ 2 callersFunction_load_universal_file
(universal_dir, param_name, key)
tests/unit/v1/moe/test_autoep_checkpoint.py:54
↓ 2 callersMethod_make_autoep_folding_metadata
(folding_spec, *, family,
deepspeed/runtime/engine.py:3832
↓ 2 callersFunction_make_empty_graph_module
()
tests/unit/v1/compile/test_graph_profile.py:79
↓ 2 callersFunction_make_model
()
tests/unit/v1/moe/test_autoep_grad_parity.py:20
↓ 2 callersFunction_make_offload_state_key
(key)
deepspeed/runtime/utils.py:1152
↓ 2 callersFunction_make_zero2_config
()
tests/unit/v1/moe/test_autoep_grad_parity.py:24
↓ 2 callersMethod_mark_as_occupied
(self, address, size)
deepspeed/runtime/zero/contiguous_memory_allocator.py:280
↓ 2 callersMethod_matches_glob
(self, rel_posix: str, globs: tuple[str, ...])
ci/tests_fetcher.py:463
↓ 2 callersFunction_mem_rows
(graph)
tests/unit/v1/compile/test_offload_opt_states.py:67
↓ 2 callersMethod_merge_base
Merge-base of ``base`` and ``HEAD``, or "" if it can't be determined. An empty result (e.g. shallow clone that doesn't reach the fork point)
ci/tests_fetcher.py:207
↓ 2 callersMethod_merge_state_dicts
(self, sd_list)
deepspeed/checkpoint/deepspeed_checkpoint.py:286
↓ 2 callersFunction_merge_zero_shards
(param_base_path, state, tp_degree, slice_shapes=None)
deepspeed/checkpoint/ds_to_universal.py:230
↓ 2 callersMethod_module_name
Dotted module name for a file under a package root, or None. e.g. deepspeed/runtime/engine.py -> deepspeed.runtime.engine tests/
ci/tests_fetcher.py:284
↓ 2 callersFunction_no_gather_coalesced
(params: Iterable[Parameter])
deepspeed/runtime/zero/partition_parameters.py:876
↓ 2 callersFunction_normalize_uc_shape
(value)
deepspeed/module_inject/layers.py:34
↓ 2 callersFunction_one_cycle_lrs
(first_stair_count, steps=16, first_step_size=8, second_step_size=8, second_stair_count=None)
tests/unit/runtime/test_lr_schedulers.py:716
↓ 2 callersMethod_optimizer_step
(self, sub_group_id)
deepspeed/runtime/superoffload/superoffload_stage3.py:91
↓ 2 callersFunction_pad_rows
(tensor: torch.Tensor, rows: int)
deepspeed/moe/ep_tp_dispatch.py:276
↓ 2 callersMethod_padding_size
(self, param)
deepspeed/runtime/zero/partition_parameters.py:1648
↓ 2 callersFunction_params
(engine)
tests/unit/v1/zero/test_zero_coalesce_grad_reduction.py:67
↓ 2 callersMethod_parse_all
Parse every file once; return (deps_by_file, raw_imports_by_file).
ci/tests_fetcher.py:410
↓ 2 callersFunction_partition_logical_tensor
(tensor, partition_dim, tp_world_size, tp_index, name=None, subparam_sizes=None)
deepspeed/module_inject/layers.py:1203
↓ 2 callersFunction_patch_aot_constructor
()
tests/unit/compile/test_backend.py:82
↓ 2 callersFunction_patch_tp_group_creation
(monkeypatch, *, rank=2, initialize_mesh_device=None)
tests/unit/model_parallelism/test_autotp_training.py:42
↓ 2 callersMethod_pre_all_gather
(self, params, params_buffers=None)
deepspeed/runtime/zero/mics.py:199
↓ 2 callersFunction_prep_inputs
(*inputs)
tests/unit/runtime/activation_checkpointing/test_activation_checkpointing.py:40
↓ 2 callersFunction_prime_factors
Returns the prime factorization of positive integer N.
deepspeed/runtime/pipe/topology.py:217
↓ 2 callersMethod_process_selected_fp32_groups_grad
Process gradients for selected columns in FP32 groups Args: param: The parameter to process param_id: ID of
deepspeed/runtime/zenflow/zenflow_stage_1_and_2.py:254
↓ 2 callersFunction_prologue
csrc/deepspeed4science/evoformer_attn/gemm/mma_from_smem.h:925
↓ 2 callersFunction_raise_if_autoep_zero3_partitioned_state
(state_dict)
deepspeed/utils/zero_to_fp32.py:116
↓ 2 callersFunction_raise_unsupported_load_balance_coeff
(value: object)
deepspeed/module_inject/auto_ep_presets/base.py:19
↓ 2 callersMethod_reassign_or_swap_out_partitioned_parameters
(self, sub_group_id)
deepspeed/runtime/superoffload/superoffload_stage3.py:114
↓ 2 callersFunction_reduce
All-reduce the input tensor across model parallel group.
deepspeed/compression/basic_layer.py:620
↓ 2 callersMethod_reduce_autoep_folding_tp_replicated_gradients
(self)
deepspeed/runtime/engine.py:2863
↓ 2 callersMethod_reduce_local_output
Reduce (sum) a new local result into the existing local results. Subclasses should override this method. For a given ``out_id``, thi
deepspeed/runtime/zero/tiling.py:170
↓ 2 callersFunction_ref_apply_rotary
(t, freqs_cos, freqs_sin)
tests/unit/sequence/test_apply_rotary_pos_emb.py:21
↓ 2 callersFunction_ref_group_meta
Reference for _group_meta: m_start = exclusive-prefix, m_size = per-group count.
tests/unit/v1/moe/test_group_gemm_triton.py:52
↓ 2 callersMethod_register_deepspeed_module
(self, module, count=[0])
deepspeed/runtime/zero/parameter_offload.py:329
↓ 2 callersMethod_release_deepcompile_compiled_backward_state
(self)
deepspeed/runtime/engine.py:5679
↓ 2 callersMethod_release_deepcompile_dynamo_config
(self)
deepspeed/runtime/engine.py:5685
↓ 2 callersMethod_release_gathered_params
(self)
deepspeed/compile/z3_eager_fallback.py:211
↓ 2 callersMethod_release_ipg_buffers
(self)
deepspeed/runtime/zero/stage_1_and_2.py:807
↓ 2 callersMethod_release_swap_buffers
(self, sub_group_id)
deepspeed/runtime/zero/stage3.py:2446
↓ 2 callersMethod_release_unclaimed_tracked_params
(self)
deepspeed/compile/z3_eager_fallback.py:195
↓ 2 callersMethod_remove_module_hooks
(self)
deepspeed/runtime/zero/parameter_offload.py:276
↓ 2 callersFunction_replace_module
(module, policy)
deepspeed/module_inject/replace_module.py:173
↓ 2 callersMethod_replace_moe_layer_without_retarget
( self, spec: MoELayerSpec, ep_size: int, ep_rank: int, )
deepspeed/module_inject/auto_ep.py:489
↓ 2 callersFunction_report_aio_statistics
csrc/aio/common/deepspeed_aio_common.cpp:47
↓ 2 callersMethod_report_progress
(self, step)
deepspeed/runtime/engine.py:3598
↓ 2 callersMethod_resolve_presets
Determine which preset(s) to use for detection.
deepspeed/module_inject/auto_ep.py:597
↓ 2 callersFunction_resolve_route_scale
Resolve the single scale applied by TokenChoiceTopKRouter.
deepspeed/module_inject/auto_ep.py:130
↓ 2 callersMethod_resolve_zero3_param_placement
(self)
deepspeed/runtime/engine.py:1874
↓ 2 callersMethod_restore_base_optimizer_state
(self, base_optimizer_group_states, base_optimizer_state_step, group_paddings)
deepspeed/runtime/zero/stage_1_and_2.py:2628
↓ 2 callersMethod_restore_from_bit16_weights
(self)
deepspeed/runtime/bf16_optimizer.py:512
↓ 2 callersMethod_restore_from_bit16_weights
(self)
deepspeed/runtime/zero/stage_1_and_2.py:2600
↓ 2 callersMethod_retarget_transformers_output_recorders
(self, spec: MoELayerSpec, replacement: nn.Module)
deepspeed/module_inject/auto_ep.py:518
↓ 2 callersFunction_retarget_transformers_output_recorders_for_modules
( *, model: nn.Module, display_name: str, recorder_key: str, retargeted_keys: set[str],
deepspeed/module_inject/auto_ep_presets/base.py:316
↓ 2 callersMethod_retrieve_unswapped_grad_partitions
(self, swap_info, dest_buffer)
deepspeed/runtime/swap_tensor/optimizer_utils.py:462
↓ 2 callersMethod_reverse_graph
Map each file -> the set of files that import it (directly).
ci/tests_fetcher.py:426
↓ 2 callersFunction_rms_norm_testing_helper
(rows: int, channels: int, do_residual: bool, dtype: DtypeEnum)
tests/unit/inference/v2/kernels/core_ops/test_rms_norm.py:33
↓ 2 callersFunction_rnn_flops
(flops, rnn_module, w_ih, w_hh, input_size)
deepspeed/profiling/flops_profiler/profiler.py:1041
↓ 2 callersFunction_rotate_half
change sign so the last dimension becomes [-odd, +even]
deepspeed/sequence/layer.py:90
↓ 2 callersFunction_route_slots
Map every (token, route) pair onto its flat slot in the [e * c] expert buffer. Routes evicted by the capacity limit are parked on one extra scrat
deepspeed/moe/sharded_moe.py:196
↓ 2 callersFunction_run_experts_grouped_mm
Compute SwiGLU expert MLP via torch._grouped_mm (grouped GEMM). Uses input dtype for casting instead of hardcoded bfloat16. Args: w1
deepspeed/moe/ep_experts.py:92
↓ 2 callersMethod_run_forward_backward
Run zero3_linear_wrap forward+backward, optionally inside autocast.
tests/unit/v1/zero/test_zero_functorch_linear.py:108
↓ 2 callersFunction_run_local
(argv: Sequence[str], *, cwd: Path | None = None)
ci/torch_latest.py:229
↓ 2 callersFunction_run_until_boundary
(engine, *, logical_dp_world_size, logical_dp_rank, grad_accum, seed)
tests/unit/v1/moe/test_autoep_grad_parity.py:84
↓ 2 callersMethod_scale_loss_by_gas
(self, prescaled_loss, eval_micro_batches=None)
deepspeed/runtime/engine.py:2631
↓ 2 callersMethod_set_deepcompile_active
Toggle DeepCompile runtime state and manage forward hooks accordingly.
deepspeed/runtime/engine.py:5655
↓ 2 callersMethod_set_ep_group
(self, ep_group)
deepspeed/moe/sharded_moe.py:574
↓ 2 callersMethod_set_fp16_partitioned_groups_flat
(self)
deepspeed/runtime/zero/stage3.py:1208
← previousnext →1,401–1,500 of 11,258, ranked by callers