MCPcopy Create free account
hub / github.com/NVIDIA/TensorRT / tokenize

Method tokenize

demo/BERT/helpers/tokenization.py:186–192  ·  view source on GitHub ↗
(self, text)

Source from the content-addressed store, hash-verified

184 self.wordpiece_tokenizer = WordpieceTokenizer(vocab=self.vocab)
185
186 def tokenize(self, text):
187 split_tokens = []
188 for token in self.basic_tokenizer.tokenize(text):
189 for sub_token in self.wordpiece_tokenizer.tokenize(token):
190 split_tokens.append(sub_token)
191
192 return split_tokens
193
194 def convert_tokens_to_ids(self, tokens):
195 return convert_by_vocab(self.vocab, tokens)

Callers 2

tokenizeMethod · 0.45

Calls 1

appendMethod · 0.45

Tested by

no test coverage detected