Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/AIS-SNU/Smart-Infinity
/ types & classes
Types & classes
624 in github.com/AIS-SNU/Smart-Infinity
⨍
Functions
4,989
◇
Types & classes
624
↓ 21 callers
Class
ElasticityConfigError
Elasticity configuration error
deepspeed/elasticity/config.py:16
↓ 13 callers
Class
Config
deepspeed/ops/csrc/includes/gelu.h:16
↓ 12 callers
Class
MMapIndexedDataset
deepspeed/runtime/data_pipeline/data_sampling/indexed_dataset.py:369
↓ 10 callers
Class
pp_int
A wrapper for integers that will return a custom string or comma-formatted string of the integer. For example, print(pp_int(1e5)) will return
deepspeed/runtime/config_utils.py:120
↓ 9 callers
Class
GatheredParameters
deepspeed/runtime/zero/partition_parameters.py:1532
↓ 8 callers
Class
CommandToken
DeepSpeedExample/megatron/deprecated_data_utils/tokenization.py:150
↓ 8 callers
Class
Tokenization
Tokenization object to hold tokenization, (processed text),and original text. Can hold tokenization as Ids or tokens. It also holds
DeepSpeedExample/megatron/deprecated_data_utils/tokenization.py:49
↓ 7 callers
Class
ReplaceWithTensorSlicing
deepspeed/module_inject/replace_module.py:31
↓ 6 callers
Class
DeepSpeedGPTInference
Initialize the DeepSpeed GPT Transformer Layer.
deepspeed/model_implementations/transformers/ds_gpt.py:9
↓ 6 callers
Class
InferenceBuilder
deepspeed/ops/op_builder/transformer_inference.py:9
↓ 6 callers
Class
RandomLTDBuilder
deepspeed/ops/op_builder/random_ltd.py:9
↓ 6 callers
Class
meg_2d_parallel_map
deepspeed/checkpoint/reshape_meg_2d.py:9
↓ 5 callers
Class
TorchCheckpointEngine
deepspeed/runtime/checkpoint_engine/torch_checkpoint_engine.py:12
↓ 5 callers
Class
TypeToken
DeepSpeedExample/megatron/deprecated_data_utils/tokenization.py:181
↓ 4 callers
Class
AsyncIOBuilder
deepspeed/ops/op_builder/async_io.py:12
↓ 4 callers
Class
DeepSpeedInferenceConfig
Sets parameters for DeepSpeed Inference Engine.
deepspeed/inference/config.py:126
↓ 4 callers
Class
SwapBufferManager
deepspeed/runtime/swap_tensor/utils.py:180
↓ 4 callers
Class
SynchronizedWallClockTimer
Group of timers. Borrowed from Nvidia Megatron code
deepspeed/utils/timer.py:33
↓ 4 callers
Class
TEColumnParallelLinear
Wrapper for the Transformer-Engine's `Linear` layer but specialized similar to megatron's `ColumnParallelLinear` layer.
DeepSpeedExample/megatron/core/transformer/custom_layers/transformer_engine.py:77
↓ 4 callers
Class
UtilsBuilder
deepspeed/ops/op_builder/utils.py:9
↓ 4 callers
Class
WeightQuantization
deepspeed/runtime/weight_quantizer.py:11
↓ 3 callers
Class
AsyncTensorSwapper
deepspeed/runtime/swap_tensor/async_swapper.py:18
↓ 3 callers
Class
DeepSpeedConfig
deepspeed/runtime/config.py:679
↓ 3 callers
Class
ElasticityConfig
Elastic config object, constructed from a param dictionary that only contains elastic config parameters, example below: If elasticity is
deepspeed/elasticity/config.py:28
↓ 3 callers
Class
ElasticityError
Base exception for all elasticity related errors
deepspeed/elasticity/config.py:10
↓ 3 callers
Class
ForwardPass
Compute a forward pass. Roughly: .. code-block:: python buffers['outputs'][buffer_id] = forward(buffers['inputs'][buffer_id])
deepspeed/runtime/pipe/schedule.py:400
↓ 3 callers
Class
GPT2Model
GPT-2 Language model.
DeepSpeedExample/megatron/model/gpt2_model.py:36
↓ 3 callers
Class
LinearLayer
deepspeed/module_inject/layers.py:32
↓ 3 callers
Class
LoadMicroBatch
Load a micro-batch into a buffer. Roughly: .. code-block:: python buffers['inputs'][buffer_id] = next(data_iter)
deepspeed/runtime/pipe/schedule.py:387
↓ 3 callers
Class
MpiBackend
deepspeed/runtime/comm/mpi.py:15
↓ 3 callers
Class
NcclBackend
deepspeed/runtime/comm/nccl.py:15
↓ 3 callers
Class
ParallelMLP
MLP. MLP will take the input with h hidden state, project it to 4*h hidden dimension, perform nonlinear transformation, and project the s
DeepSpeedExample/megatron/model/transformer.py:60
↓ 3 callers
Class
ParallelSelfAttention
Parallel self-attention layer abstract class. Self-attention layer takes input with size [b, s, h] and returns output of the same size.
DeepSpeedExample/megatron/model/transformer.py:138
↓ 3 callers
Class
PipelineError
Errors related to the use of deepspeed.PipelineModule
deepspeed/runtime/pipe/module.py:25
↓ 3 callers
Class
RaceDataset
DeepSpeedExample/tasks/race/data.py:19
↓ 3 callers
Class
RecvActivation
Receive activations from the previous stage in the pipeline. Roughly: .. code-block:: python buffers['inputs'][buffer_id] = recv()
deepspeed/runtime/pipe/schedule.py:444
↓ 3 callers
Class
SendActivation
Send activations to the next stage in the pipeline. Roughly: .. code-block:: python send(buffers['outputs'][buffer_id]) .. not
deepspeed/runtime/pipe/schedule.py:428
↓ 3 callers
Class
SparsityConfig
Abstract Configuration class to store `sparsity configuration of a self attention layer`. It contains shared property of different block-sparse sp
deepspeed/ops/sparse_attention/sparsity_config.py:10
↓ 3 callers
Class
SwapBufferPool
deepspeed/runtime/swap_tensor/utils.py:96
↓ 3 callers
Class
model_3d_desc
deepspeed/checkpoint/reshape_3d_utils.py:17
↓ 2 callers
Class
BackwardPass
Compute a backward pass and accumulate gradients. Roughly: .. code-block:: python outputs = buffers['outputs'][buffer_id] g
deepspeed/runtime/pipe/schedule.py:412
↓ 2 callers
Class
BlockData
Serializable data structure for holding data for blocks -- embeddings and necessary metadata for REALM
DeepSpeedExample/megatron/data/realm_index.py:17
↓ 2 callers
Class
CheckOverflow
Checks for overflow in gradient across parallel process
deepspeed/runtime/utils.py:176
↓ 2 callers
Class
Classification
DeepSpeedExample/megatron/model/classification.py:29
↓ 2 callers
Class
ContiguousMemoryAllocator
deepspeed/runtime/zero/contiguous_memory_allocator.py:16
↓ 2 callers
Class
CupyBackend
deepspeed/runtime/compression/cupy.py:11
↓ 2 callers
Class
CurriculumScheduler
deepspeed/runtime/data_pipeline/curriculum_scheduler.py:11
↓ 2 callers
Class
DeepSpeedAutotuningConfig
deepspeed/autotuning/config.py:10
↓ 2 callers
Class
DeepSpeedBERTInference
Initialize the DeepSpeed BERT Transformer Layer.
deepspeed/model_implementations/transformers/ds_bert.py:9
↓ 2 callers
Class
DeepSpeedConfigError
deepspeed/runtime/config.py:89
↓ 2 callers
Class
DeepSpeedInferenceConfig
Initialize the DeepSpeed Transformer Config. Arguments: hidden_size: The hidden size of the transformer layer intermed
deepspeed/ops/transformer/inference/config.py:21
↓ 2 callers
Class
DeepSpeedMegatronGPTInference
Initialize the DeepSpeed Megatron GPT Transformer Layer.
deepspeed/model_implementations/transformers/ds_megatron_gpt.py:9
↓ 2 callers
Class
DeepSpeedMoEMLP
deepspeed/ops/transformer/inference/moe_inference.py:134
↓ 2 callers
Class
DeepSpeedSelfAttention
deepspeed/ops/transformer/inference/ds_attention.py:16
↓ 2 callers
Class
DeepSpeedTransformerConfig
Initialize the DeepSpeed Transformer Config. Arguments: batch_size: The maximum batch size used for running the kernel on each GP
deepspeed/ops/transformer/transformer.py:34
↓ 2 callers
Class
DeepSpeedZeRoOffload
deepspeed/runtime/zero/parameter_offload.py:201
↓ 2 callers
Class
DistributedBatchSampler
Similar to normal implementation of distributed sampler, except implementation is at the batch sampler level, instead of just the sampler leve
DeepSpeedExample/megatron/data/samplers.py:78
↓ 2 callers
Class
DummyOptim
Dummy optimizer presents model parameters as a param group, this is primarily used to allow ZeRO-3 without an optimizer
deepspeed/runtime/utils.py:40
↓ 2 callers
Class
DynamicLossScaler
Class that manages dynamic loss scaling. It is recommended to use :class:`DynamicLossScaler` indirectly, by supplying ``dynamic_loss_scale
DeepSpeedExample/megatron/fp16/loss_scaler.py:76
↓ 2 callers
Class
DynamicLossScaler
Class that manages dynamic loss scaling. It is recommended to use :class:`DynamicLossScaler` indirectly, by supplying ``dynamic_loss_scale=T
deepspeed/runtime/fp16/loss_scaler.py:91
↓ 2 callers
Class
FP16_Optimizer
FP16 Optimizer for training fp16 models. Handles loss scaling. For usage example please see, TODO: DeepSpeed V2 Tutorial
deepspeed/runtime/fp16/fused_optimizer.py:22
↓ 2 callers
Class
FlopsProfiler
Measures the latency, number of estimated floating-point operations and parameters of each module in a PyTorch model. The flops-profiler profiles
deepspeed/profiling/flops_profiler/profiler.py:23
↓ 2 callers
Class
GPT2Dataset
DeepSpeedExample/megatron/deprecated_data_utils/datasets.py:468
↓ 2 callers
Class
GroupQuantizer
deepspeed/module_inject/replace_module.py:143
↓ 2 callers
Class
ICTDataset
Dataset containing sentences and their blocks for an inverse cloze task.
DeepSpeedExample/megatron/data/ict_dataset.py:38
↓ 2 callers
Class
IREncoderBertModel
BERT-based encoder for queries or blocks used for learned information retrieval.
DeepSpeedExample/megatron/model/realm_model.py:147
↓ 2 callers
Class
IdentityLayer
DeepSpeedExample/megatron/mpu/tests/commons.py:25
↓ 2 callers
Class
IdentityLayer2D
DeepSpeedExample/megatron/mpu/tests/test_layers.py:176
↓ 2 callers
Class
IdentityLayer3D
DeepSpeedExample/megatron/mpu/tests/test_layers.py:318
↓ 2 callers
Class
IndexedDataset
Loader for IndexedDataset
DeepSpeedExample/megatron/data/indexed_dataset.py:127
↓ 2 callers
Class
IndexedDataset
Loader for IndexedDataset
deepspeed/runtime/data_pipeline/data_sampling/indexed_dataset.py:138
↓ 2 callers
Class
MMapIndexedDatasetBuilder
deepspeed/runtime/data_pipeline/data_sampling/indexed_dataset.py:575
↓ 2 callers
Class
MatMul
Block-Sparse MatMul class; this class handles three types of matrix-multiplication: - sparse = dense X dense - dense = sparse X dense
deepspeed/ops/sparse_attention/matmul.py:628
↓ 2 callers
Class
MiCS_AllGatherCoalescedHandle
This handle assumes that no need to copy data out from a contiguous tensor
deepspeed/runtime/zero/mics.py:31
↓ 2 callers
Class
Normalize
deepspeed/module_inject/layers.py:56
↓ 2 callers
Class
OptimizerStep
Performs one step with the optimizer and zeros gradients. .. note:: Should be issued after :class:`ReduceGrads` and :class:`ReduceTiedGrads`.
deepspeed/runtime/pipe/schedule.py:347
↓ 2 callers
Class
OptimizerSwapOp
deepspeed/runtime/swap_tensor/pipelined_optimizer_swapper.py:19
↓ 2 callers
Class
PartitionedTensor
deepspeed/runtime/utils.py:621
↓ 2 callers
Class
PipeDataParallelTopology
A topology specialization for hybrid data and pipeline parallelism. Uses data parallelism on the last dimension to encourage gradient
deepspeed/runtime/pipe/topology.py:232
↓ 2 callers
Class
QuantAct
Class to quantize given activations. Note that when using this function, the input activation quantization range will be fixed for all tokens
deepspeed/compression/basic_layer.py:17
↓ 2 callers
Class
ReduceGrads
Reduce the computed gradients among data-parallel processes within the stage.
deepspeed/runtime/pipe/schedule.py:357
↓ 2 callers
Class
SpatialInferenceBuilder
deepspeed/ops/op_builder/spatial_inference.py:9
↓ 2 callers
Class
SwapBuffer
deepspeed/runtime/swap_tensor/utils.py:37
↓ 2 callers
Class
TELayerNorm
Wrapper for the Transformer-Engine's `LayerNorm`.
DeepSpeedExample/megatron/core/transformer/custom_layers/transformer_engine.py:10
↓ 2 callers
Class
TERowParallelLinear
Wrapper for the Transformer-Engine's `Linear` layer but specialized similar to megatron's `RowParallelLinear` layer.
DeepSpeedExample/megatron/core/transformer/custom_layers/transformer_engine.py:96
↓ 2 callers
Class
ThroughputTimer
deepspeed/utils/timer.py:153
↓ 2 callers
Class
Timers
Group of timers.
DeepSpeedExample/megatron/global_vars.py:200
↓ 2 callers
Class
Tokenizer
Tokenizer object that handles text tokenization, command tokens, and type tokens. Command tokens and text tokens are stored together in o
DeepSpeedExample/megatron/deprecated_data_utils/tokenization.py:207
↓ 2 callers
Class
TopKGate
Gate module which implements Top2Gating as described in Gshard_. :: gate = TopKGate(model_dim, num_experts) l_aux, combine_weight
deepspeed/moe/sharded_moe.py:343
↓ 2 callers
Class
TorchBackend
A light-weight wrapper class for torch.distributed API. Only a subset of functions are wrapped. Once the init_process_group i
deepspeed/comm/torch.py:39
↓ 2 callers
Class
VectorMatMulOp
deepspeed/ops/transformer/inference/op_binding/vector_matmul.py:12
↓ 2 callers
Class
ZeRORuntimeException
deepspeed/runtime/zero/utils.py:35
↓ 2 callers
Class
_BertWordPieceTokenizer
Original BERT wordpiece tokenizer.
DeepSpeedExample/megatron/tokenizer/tokenizer.py:127
↓ 2 callers
Class
fragment_address
deepspeed/utils/tensor_fragment.py:12
↓ 1 callers
Class
ActivationQuantConfig
deepspeed/inference/config.py:104
↓ 1 callers
Class
AllGatherCoalescedHandle
deepspeed/runtime/zero/partition_parameters.py:539
↓ 1 callers
Class
AllGatherHandle
deepspeed/runtime/zero/partition_parameters.py:525
↓ 1 callers
Class
AnnealingLR
Anneals the learning rate.
DeepSpeedExample/megatron/learning_rates.py:23
↓ 1 callers
Class
AsyncPartitionedParameterSwapper
deepspeed/runtime/swap_tensor/partitioned_param_swapper.py:36
↓ 1 callers
Class
Autotuner
The DeepSpeed Autotuner automatically discovers the optimal DeepSpeed configuration that delivers good training speed. The Autotuner uses model inform
deepspeed/autotuning/autotuner.py:42
next →
1–100 of 624, ranked by callers