MCPcopy Create free account
hub / github.com/brightmart/text_classification / __init__

Method __init__

a00_Bert/tokenization.py:113–117  ·  view source on GitHub ↗
(self, vocab_file, do_lower_case=True)

Source from the content-addressed store, hash-verified

111 """Runs end-to-end tokenziation."""
112
113 def __init__(self, vocab_file, do_lower_case=True):
114 self.vocab = load_vocab(vocab_file)
115 self.inv_vocab = {v: k for k, v in self.vocab.items()}
116 self.basic_tokenizer = BasicTokenizer(do_lower_case=do_lower_case)
117 self.wordpiece_tokenizer = WordpieceTokenizer(vocab=self.vocab)
118
119 def tokenize(self, text):
120 split_tokens = []

Callers

nothing calls this directly

Calls 3

load_vocabFunction · 0.85
BasicTokenizerClass · 0.85
WordpieceTokenizerClass · 0.85

Tested by

no test coverage detected