(self, config: TelechatConfig)
| 595 | |
| 596 | class TelechatModel(TelechatPreTrainedModel): |
| 597 | def __init__(self, config: TelechatConfig): |
| 598 | super().__init__(config) |
| 599 | |
| 600 | self.embed_dim = config.hidden_size |
| 601 | self.num_heads = config.n_head |
| 602 | self.config = config |
| 603 | self.word_embeddings = nn.Embedding(config.vocab_size, self.embed_dim) |
| 604 | if self.config.embed_layernorm: |
| 605 | self.word_embeddings_layernorm = MixedFusedRMSNorm(self.embed_dim, eps=config.layer_norm_epsilon) |
| 606 | |
| 607 | self.h = nn.ModuleList([TelechatBlock(config, _) for _ in range(config.num_hidden_layers)]) |
| 608 | self.ln_f = MixedFusedRMSNorm(self.embed_dim, eps=config.layer_norm_epsilon) |
| 609 | self.gradient_checkpointing = False |
| 610 | self.post_init() |
| 611 | |
| 612 | def get_input_embeddings(self): |
| 613 | return self.word_embeddings |
nothing calls this directly
no test coverage detected