MCPcopy Create free account
hub / github.com/cli99/llm-analysis / ParallelismConfig

Class ParallelismConfig

llm_analysis/config.py:115–126  ·  view source on GitHub ↗

Source from the content-addressed store, hash-verified

113
114@dataclass
115class ParallelismConfig:
116 tp_size: int = 1 # tensor parallelism size, Megatron-LM tensor parallelism implementation
117 pp_size: int = 1 # pipeline parallelism size, Megatron-LM pipeline parallelism implementation
118 dp_size: int = (
119 1 # data parallelism size, DeepSpeed Zero parallelism implementation
120 )
121 ep_size: int = 1 # expert parallelism size
122 sp_size: int = None # sequence parallelism size, Megatron-LM sequence parallelism implementation
123
124 def __post_init__(self):
125 if self.sp_size is None:
126 self.sp_size = self.tp_size
127
128
129# model name and configurations mapping populated from MODEL_CONFIG_DIR_NAME

Callers 13

__init__Method · 0.90
inferFunction · 0.90
trainFunction · 0.90
test_training_zero3_1Function · 0.90
test_training_zero3_2Function · 0.90
test_training_mt_nlg_1Function · 0.90
test_training_mt_nlg_2Function · 0.90
test_llama2_70bFunction · 0.90

Calls

no outgoing calls

Tested by 9

test_training_zero3_1Function · 0.72
test_training_zero3_2Function · 0.72
test_training_mt_nlg_1Function · 0.72
test_training_mt_nlg_2Function · 0.72
test_llama2_70bFunction · 0.72