MCPcopy Create free account
hub / github.com/apache/singa / remove_stopwords

Function remove_stopwords

examples/rnn/imdb_data.py:140–153  ·  view source on GitHub ↗

lambda fn for removing stopwrods

(text, tokenizer, stopword_list, is_lower_case=False)

Source from the content-addressed store, hash-verified

138
139
140def remove_stopwords(text, tokenizer, stopword_list, is_lower_case=False):
141 ''' lambda fn for removing stopwrods '''
142 tokens = tokenizer.tokenize(text)
143 tokens = [token.strip() for token in tokens]
144 if is_lower_case:
145 filtered_tokens = [
146 token for token in tokens if token not in stopword_list
147 ]
148 else:
149 filtered_tokens = [
150 token for token in tokens if token.lower() not in stopword_list
151 ]
152 filtered_text = ' '.join(filtered_tokens)
153 return filtered_text
154
155
156def tokenize(x):

Callers

nothing calls this directly

Calls 1

tokenizeMethod · 0.45

Tested by

no test coverage detected