Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/ICTRC/Parsivar
/ functions
Functions
79 in github.com/ICTRC/Parsivar
⨍
Functions
79
◇
Types & classes
12
↓ 42 callers
Method
select_candidate
(self, candidate_list, lexicon_set=None)
parsivar/stemmer.py:56
↓ 21 callers
Method
remove_postfixes
(self, word, postfix)
parsivar/stemmer.py:93
↓ 17 callers
Method
remove_prefixes
(self, word, prefix)
parsivar/stemmer.py:81
↓ 11 callers
Method
get_word_probability
(self, word)
parsivar/spell_checker.py:141
↓ 9 callers
Method
load_var
(self, load_path)
parsivar/data_helper.py:74
↓ 7 callers
Method
bigram_markov_factor
(self, yi_1, yi)
parsivar/spell_checker.py:130
↓ 6 callers
Method
is_number
(self, word)
parsivar/normalizer.py:419
↓ 6 callers
Method
map_irregular_noun
(self, word)
parsivar/stemmer.py:105
↓ 5 callers
Method
save_var
(self, save_path, variable)
parsivar/data_helper.py:80
↓ 4 callers
Method
sub_alphabets
(self, doc_string)
parsivar/normalizer.py:59
↓ 4 callers
Method
tokenize_words
(self, doc_string)
parsivar/tokenizer.py:8
↓ 3 callers
Method
build_similar_words
(self, word_seq, index, zi, operation)
parsivar/spell_checker.py:94
↓ 3 callers
Method
isword
(self, x)
parsivar/spell_checker.py:152
↓ 3 callers
Method
load_dictionary
(self, file_path)
parsivar/normalizer.py:50
↓ 2 callers
Method
clean_text
(self, text_doc, new_line_elimination)
parsivar/data_helper.py:11
↓ 2 callers
Method
is_all_latin
(self, word)
parsivar/postagger.py:48
↓ 2 callers
Method
is_postfix
(self, word, post)
parsivar/stemmer.py:77
↓ 2 callers
Method
is_prefix
(self, word, prefix)
parsivar/stemmer.py:73
↓ 2 callers
Method
list2num
(self, numerical_section_list)
parsivar/normalizer.py:393
↓ 1 callers
Method
build_stem_dictionary
(self, normalizer, verb_tense_path, mokasar_noun_path)
parsivar/data_helper.py:87
↓ 1 callers
Method
char_switcher
(self, ch)
parsivar/normalizer.py:614
↓ 1 callers
Method
characterize
(self, word)
parsivar/normalizer.py:496
↓ 1 callers
Method
convert2num
(self, numerical_section_list)
parsivar/normalizer.py:402
↓ 1 callers
Method
deletion
(self, word)
parsivar/spell_checker.py:27
↓ 1 callers
Method
escalation
(self, word)
parsivar/normalizer.py:601
↓ 1 callers
Method
esp_check
(self, char1, char2)
parsivar/normalizer.py:530
↓ 1 callers
Method
find_date_part
(self, token_list)
parsivar/normalizer.py:343
↓ 1 callers
Method
find_number_location
(self, token_list)
parsivar/normalizer.py:422
↓ 1 callers
Method
get_possible_words
(self, word_seq, index)
parsivar/spell_checker.py:182
↓ 1 callers
Method
insertion
(self, word)
parsivar/spell_checker.py:48
↓ 1 callers
Method
is_ingroup_substitution
(self, main_word, candidate_word)
parsivar/spell_checker.py:240
↓ 1 callers
Method
make_word
(self, chp)
parsivar/normalizer.py:589
↓ 1 callers
Method
map_char
(self, word)
parsivar/normalizer.py:553
↓ 1 callers
Method
map_switcher
(self, ch)
parsivar/normalizer.py:577
↓ 1 callers
Method
merg_tokens
(self, token_list, token_merger_model, separator_char)
parsivar/token_merger.py:78
↓ 1 callers
Method
nestedtree_to_list
(self, tree, separator_char, d=0)
parsivar/token_merger.py:65
↓ 1 callers
Method
normalize
(self, doc_string, new_line_elimination=False)
parsivar/normalizer.py:296
↓ 1 callers
Method
normalize_dates
(self, token_list)
parsivar/normalizer.py:381
↓ 1 callers
Method
normalize_numbers
(self, token_list, converted="")
parsivar/normalizer.py:447
↓ 1 callers
Method
parse
(self, token_list)
parsivar/postagger.py:56
↓ 1 callers
Method
parse
(self, tagged_sent)
parsivar/token_merger.py:18
↓ 1 callers
Method
parse_tagged_sent
(self, sentences, verbose=False, top_relation_label='null')
parsivar/dependency.py:35
↓ 1 callers
Method
pingilish2persian
(self, pinglish_words_list)
parsivar/normalizer.py:477
↓ 1 callers
Method
select_correct_spell
(self, candidate_list, next_candidates, next_next_candidates, prev_word, current_word)
parsivar/spell_checker.py:256
↓ 1 callers
Method
select_n_best
(self, c_list, o_list, n=3)
parsivar/spell_checker.py:214
↓ 1 callers
Method
space_correction
(self, doc_string)
parsivar/normalizer.py:219
↓ 1 callers
Method
space_correction_plus1
(self, doc_string)
parsivar/normalizer.py:240
↓ 1 callers
Method
space_correction_plus2
(self, doc_string)
parsivar/normalizer.py:249
↓ 1 callers
Method
space_correction_plus3
(self, doc_string)
parsivar/normalizer.py:269
↓ 1 callers
Method
spell_corrector
(self, doc_string)
parsivar/spell_checker.py:359
↓ 1 callers
Method
splitting
(self, word)
parsivar/spell_checker.py:38
↓ 1 callers
Method
substitution
(self, word)
parsivar/spell_checker.py:62
↓ 1 callers
Method
switcher
(self, ch)
parsivar/normalizer.py:516
↓ 1 callers
Method
train_merger
(self, train_file_path, test_split=0.1)
parsivar/token_merger.py:25
↓ 1 callers
Method
transposition
(self, word)
parsivar/spell_checker.py:78
Method
__init__
An interface for parsing with the Malt Parser. :param parser_dirname: The path to the maltparser directory that contains the
parsivar/dependency.py:12
Method
__init__
(self, _normalizer=None, _tokenizer=None, _stemmer=None, _tagger=None)
parsivar/dependency.py:67
Method
__init__
(self)
parsivar/spell_checker.py:11
Method
__init__
(self)
parsivar/stemmer.py:7
Method
__init__
(self)
parsivar/tokenizer.py:5
Method
__init__
(self)
parsivar/data_helper.py:8
Method
__init__
(self)
parsivar/chunker.py:4
Method
__init__
(self, stanford_postagger_model=None, wapiti_postagger_model=None,
parsivar/postagger.py:6
Method
__init__
(self)
parsivar/token_merger.py:14
Method
__init__
(self, half_space_char='\u200c', statistical_space_correction=False,
parsivar/normalizer.py:11
Method
__init__
(self)
parsivar/normalizer.py:319
Method
__init__
(self)
parsivar/normalizer.py:466
Method
add_space
(self, mystring)
parsivar/data_helper.py:62
Method
add_tab
(self, mystring)
parsivar/tokenizer.py:46
Method
chunk_sentence
(self, pos_taged_tuples)
parsivar/chunker.py:39
Method
convert_nestedtree2rawstring
(self, tree, d=0)
parsivar/chunker.py:25
Method
convert_to_stem
(self, word, word_pos=None)
parsivar/stemmer.py:111
Method
eliminate_pattern
(self, mystring)
parsivar/data_helper.py:71
Method
features
`tokens` = a POS-tagged sentence [(w1, t1), ...] `index` = the index of the token we want to extract features for `hist
parsivar/token_merger.py:92
Method
make_trainable_corpus
(self, in_file, out_file)
parsivar/dependency.py:95
Method
parse_sents
(self, sents, verbose=False)
parsivar/dependency.py:119
Method
replace_newline_with_dot
(self, mystring)
parsivar/data_helper.py:68
Method
tokenize_sentences
(self, doc_string)
parsivar/tokenizer.py:13
Method
triplets2tagged_pairs
(iob_sent)
parsivar/token_merger.py:47