(self, weight_bit_width: int)
| 843 | ) |
| 844 | |
| 845 | def quantize(self, weight_bit_width: int): |
| 846 | from .quantization import quantize |
| 847 | quantize(self.encoder, weight_bit_width) |
| 848 | return self |
| 849 | |
| 850 | |
| 851 | class ChatGLMForConditionalGeneration(ChatGLMPreTrainedModel): |