(self, tokenizer, data_file, batch_size)
| 10 | |
| 11 | class DualEncoderDataLoader(pl.LightningDataModule): |
| 12 | def __init__(self, tokenizer, data_file, batch_size): |
| 13 | super().__init__() |
| 14 | self.tokenizer = tokenizer |
| 15 | self.data_file = data_file |
| 16 | self.batch_size = batch_size |
| 17 | |
| 18 | def encode_sentences(self, positives, negatives, max_length=512, pad_to_max_length=False, return_tensors="pt"): |
| 19 | encoded_dict = self.tokenizer( |
nothing calls this directly
no outgoing calls
no test coverage detected