(
sources,
targets,
tokenizer: transformers.PreTrainedTokenizer,
)
| 94 | |
| 95 | |
| 96 | def preprocess( |
| 97 | sources, |
| 98 | targets, |
| 99 | tokenizer: transformers.PreTrainedTokenizer, |
| 100 | ): |
| 101 | sources_tokenized = _tokenize_fn(sources, tokenizer) |
| 102 | input_ids = sources_tokenized["input_ids"] |
| 103 | return dict(input_ids=input_ids, labels=copy.deepcopy(input_ids)) |
| 104 | |
| 105 | |
| 106 | class SupervisedDataset(Dataset): |
no test coverage detected