MCPcopy Create free account
hub / github.com/deepspeedai/DeepSpeed / _get_sequence_data_parallel_group

Function _get_sequence_data_parallel_group

deepspeed/utils/groups.py:845–851  ·  view source on GitHub ↗
()

Source from the content-addressed store, hash-verified

843
844
845def _get_sequence_data_parallel_group():
846 global mpu
847 # When sequence parallelism is enabled, the process group for zero sharding and
848 # gradient allreduce must be across both dimensions of data and sequence parallelism.
849 if mpu is not None and hasattr(mpu, 'get_sequence_data_parallel_group'):
850 return mpu.get_sequence_data_parallel_group()
851 return _get_data_parallel_group()
852
853
854def _get_expert_model_parallel_world_size():

Callers 1

_get_broadcast_src_rankFunction · 0.85

Calls 1

_get_data_parallel_groupFunction · 0.85

Tested by

no test coverage detected