(self, weight_bit_width: int)
| 1101 | ) |
| 1102 | |
| 1103 | def quantize(self, weight_bit_width: int): |
| 1104 | # from .quantization import quantize |
| 1105 | quantize(self.encoder, weight_bit_width) |
| 1106 | return self |
| 1107 | |
| 1108 | |
| 1109 | class ChatGLMForConditionalGeneration(ChatGLMPreTrainedModel): |