Mean-pool token embeddings, ignoring padding positions.
(last_hidden_states: Tensor, attention_mask: Tensor)
| 62 | |
| 63 | |
| 64 | def average_pool(last_hidden_states: Tensor, attention_mask: Tensor) -> Tensor: |
| 65 | """Mean-pool token embeddings, ignoring padding positions.""" |
| 66 | last_hidden = last_hidden_states.masked_fill(~attention_mask[..., None].bool(), 0.0) |
| 67 | return last_hidden.sum(dim=1) / attention_mask.sum(dim=1)[..., None] |
| 68 | |
| 69 | |
| 70 | def load_embedding_model(model_name: str, model_revision: str): |