MCPcopy Create free account

hub / github.com/ShannonAI/mrc-for-flat-nested-ner / functions

Functions111 in github.com/ShannonAI/mrc-for-flat-nested-ner

↓ 7 callersFunctionset_random_seed
set seeds for reproducibility
utils/random_seed.py:17
↓ 6 callersMethodpad
(self, lst, value=0, max_length=None)
datasets/mrc_ner_dataset.py:171
↓ 5 callersFunctionget_labels
gets the list of labels for this data set.
datasets/tagger_ner_dataset.py:11
↓ 5 callersFunctiontransform_predictions_to_labels
shape: sequence_input_lst: [batch_size, seq_len, num_labels] wordpiece_mask: [batch_size, seq_len, ]
metrics/functional/tagger_span_f1.py:10
↓ 4 callersFunctionget_entity_from_bmes_lst
reuse the code block from https://github.com/jiesutd/NCRFpp/blob/105a53a321eca9c1280037c473967858e01aaa43/utils/metric.py#L73 Many tha
metrics/functional/tagger_span_f1.py:68
↓ 3 callersMethodcompute_loss
(self, sequence_logits, sequence_labels, input_mask=None)
train/bert_tagger_trainer.py:150
↓ 3 callersMethodget_dataloader
get train/dev/test dataloader
train/bert_tagger_trainer.py:248
↓ 3 callersMethodget_dataloader
get training dataloader
train/mrc_ner_trainer.py:326
↓ 3 callersFunctionload_data_in_conll
Desc: load data in conll format Returns: [([word1, word2, word3, word4], [label1, label2, label3, label4]), ([word5,
datasets/tagger_ner_dataset.py:49
↓ 2 callersMethod__init__
(self, hidden_size, num_label, dropout_rate, act_func="gelu", intermediate_hidden_size=None)
models/classifier.py:47
↓ 2 callersFunctionbmes_decode
decode inputs to tags Args: char_label_list: list of tuple (word, bmes-tag) Returns: tags Examples: >>> x = [
utils/bmes_decode.py:26
↓ 2 callersMethodcompute_loss
(self, start_logits, end_logits, span_logits, start_labels, end_labels, match_labels, sta
train/mrc_ner_trainer.py:155
↓ 2 callersFunctionfind_illegal_entity
(query, context_tokens, labels, model_path, is_chinese=True, do_lower_case=True)
tests/illegal_entity_boundary.py:45
↓ 2 callersFunctionget_entity_from_bmes_lst
reuse the code block from https://github.com/jiesutd/NCRFpp/blob/105a53a321eca9c1280037c473967858e01aaa43/utils/metric.py#L73 Many tha
tests/extract_entity_span.py:7
↓ 2 callersFunctionget_parser
return basic arg parser
utils/get_parser.py:9
↓ 1 callersMethod__init__
(self, **kwargs)
models/model_config.py:17
↓ 1 callersFunction_improve_answer_span
Returns tokenized answer spans that better match the annotated answer.
tests/illegal_entity_boundary.py:112
↓ 1 callersMethodadd_model_specific_args
(parent_parser)
train/bert_tagger_trainer.py:78
↓ 1 callersMethodadd_model_specific_args
(parent_parser)
train/mrc_ner_trainer.py:83
↓ 1 callersFunctioncompute_tagger_span_f1
(sequence_pred_lst, sequence_gold_lst)
metrics/functional/tagger_span_f1.py:38
↓ 1 callersFunctionconvert_file
Convert GENIA data to MRC format
ner2mrc/genia2mrc.py:10
↓ 1 callersFunctionconvert_file
Convert MSRA raw data to MRC format
ner2mrc/msra2mrc.py:11
↓ 1 callersFunctioncount_confusion_matrix
(pred_entities, gold_entities)
metrics/functional/tagger_span_f1.py:54
↓ 1 callersFunctioncount_entity_with_mrc_ner_format
mrc_data_example: { "context": "The chemiluminescent ( CL ) response of interferon - gamma - treated U937 ( IFN - U937 ) cells to sen
tests/assert_correct_dataset.py:19
↓ 1 callersFunctioncount_entity_with_sequence_ner_format
(data_path, is_nested=False)
tests/assert_correct_dataset.py:59
↓ 1 callersFunctioncount_max_length
(data_sign)
tests/count_sequence_max_length.py:86
↓ 1 callersFunctionevaluate
(ckpt, hparams_file, gpus=[0, 1], max_length=300)
evaluate/tagger_ner_evaluate.py:16
↓ 1 callersFunctionevaluate
(ckpt, hparams_file, gpus=[0, 1], max_length=300)
evaluate/mrc_ner_evaluate.py:17
↓ 1 callersFunctionextract_flat_spans
Extract flat-ner spans from start/end/match logits Args: start_pred: [seq_len], 1/True for start, 0/False for non-start end_p
metrics/functional/query_span_f1.py:65
↓ 1 callersFunctionextract_nested_spans
(start_preds, end_preds, match_preds, start_label_mask, end_label_mask, pseudo_tag="TAG")
metrics/functional/query_span_f1.py:50
↓ 1 callersFunctionfind_best_checkpoint_on_dev
(output_dir: str, log_file: str = "eval_result_log.txt", only_keep_the_best_ckpt: bool = False)
train/bert_tagger_trainer.py:278
↓ 1 callersFunctionfind_best_checkpoint_on_dev
(output_dir: str, log_file: str = "eval_result_log.txt", only_keep_the_best_ckpt: bool = False)
train/mrc_ner_trainer.py:353
↓ 1 callersFunctionget_dataloader
(config, data_prefix="test")
inference/tagger_ner_inference.py:19
↓ 1 callersFunctionget_dataloader
(config, data_prefix="test")
inference/mrc_ner_inference.py:17
↓ 1 callersFunctionget_parser
()
inference/tagger_ner_inference.py:31
↓ 1 callersFunctionget_parser
()
inference/mrc_ner_inference.py:41
↓ 1 callersFunctionget_query_index_to_label_cate
(dataset_sign)
inference/mrc_ner_inference.py:32
↓ 1 callersFunctionload_dataexamples
(file_path, )
tests/illegal_entity_boundary.py:8
↓ 1 callersFunctionmain
()
inference/tagger_ner_inference.py:46
↓ 1 callersFunctionmain
()
inference/mrc_ner_inference.py:55
↓ 1 callersFunctionmain
(mrc_data_dir, seq_data_dir, seq_data_suffix="char.bmes", is_nested=False)
tests/assert_correct_dataset.py:80
↓ 1 callersFunctionmain
()
tests/count_mrc_max_length.py:22
↓ 1 callersFunctionmain
(data_dir, data_sign, datafile_suffix=".word.bmes")
tests/collect_entity_labels.py:17
↓ 1 callersFunctionmain
()
ner2mrc/genia2mrc.py:41
↓ 1 callersFunctionmain
()
ner2mrc/msra2mrc.py:42
↓ 1 callersFunctionmain
main
train/bert_tagger_trainer.py:308
↓ 1 callersFunctionmain
main
train/mrc_ner_trainer.py:383
↓ 1 callersFunctionquery_span_f1
Compute span f1 according to query-based model output Args: start_preds: [bsz, seq_len] end_preds: [bsz, seq_len] mat
metrics/functional/query_span_f1.py:11
↓ 1 callersFunctionreverse_style
(input_string)
metrics/functional/tagger_span_f1.py:118
↓ 1 callersFunctionreverse_style
(input_string)
tests/extract_entity_span.py:56
↓ 1 callersFunctionrun_dataset
test dataset
datasets/mrc_ner_dataset.py:178
↓ 1 callersFunctiontokenize_word
(model_path, do_lower_case=False)
tests/bert_tokenizer.py:9
↓ 1 callersMethodtrain_dataloader
(self)
train/bert_tagger_trainer.py:239
↓ 1 callersMethodtrain_dataloader
(self)
train/mrc_ner_trainer.py:317
Method__getattr__
other dataset func
datasets/truncate_dataset.py:21
Method__getitem__
(self, item)
datasets/truncate_dataset.py:18
Method__getitem__
Args: item: int, idx Returns: tokens: tokens of query + context, [seq_len] token_type_ids: token
datasets/mrc_ner_dataset.py:38
Method__getitem__
(self, item)
datasets/tagger_ner_dataset.py:101
Method__init__
(self, term, tag, begin, end)
utils/bmes_decode.py:10
Method__init__
(self, reduce_group=None, reduce_op=None)
metrics/tagger_span_f1.py:11
Method__init__
(self, reduce_group=None, reduce_op=None, flat=False)
metrics/query_span_f1.py:16
Method__init__
(self)
tests/count_sequence_max_length.py:21
Method__init__
(self)
tests/count_sequence_max_length.py:34
Method__init__
(self)
tests/count_sequence_max_length.py:47
Method__init__
(self)
tests/count_sequence_max_length.py:60
Method__init__
(self)
tests/count_sequence_max_length.py:75
Method__init__
(self, dataset: Dataset, max_num: int = 100)
datasets/truncate_dataset.py:11
Method__init__
(self, json_path, tokenizer: BertWordPieceTokenizer, max_length: int = 512, possible_only=False,
datasets/mrc_ner_dataset.py:22
Method__init__
(self, data_path, tokenizer: AutoTokenizer, dataset_signature, max_length: int = 512, is_chin
datasets/tagger_ner_dataset.py:86
Method__init__
(self, **kwargs)
models/model_config.py:10
Method__init__
(self, hidden_size, num_label)
models/classifier.py:11
Method__init__
(self, hidden_size, num_label, dropout_rate, act_func="gelu", intermediate_hidden_size=None)
models/classifier.py:22
Method__init__
(self, config)
models/bert_query_ner.py:14
Method__init__
(self, config)
models/bert_tagger.py:13
Method__init__
Initialize a model, tokenizer and config.
train/bert_tagger_trainer.py:36
Method__init__
Initialize a model, tokenizer and config.
train/mrc_ner_trainer.py:37
Method__len__
(self)
datasets/truncate_dataset.py:15
Method__len__
(self)
datasets/mrc_ner_dataset.py:35
Method__len__
(self)
datasets/tagger_ner_dataset.py:98
Method__repr__
(self)
utils/bmes_decode.py:22
Method__str__
(self)
utils/bmes_decode.py:19
Functioncollate_to_max_length
pad to maximum length of this batch Args: batch: a batch of samples, each contains a list of field data(Tensor): tokens,
datasets/collate_functions.py:51
Methodconfigure_optimizers
Prepare optimizer and schedule (linear warmup and decay)
train/bert_tagger_trainer.py:102
Methodconfigure_optimizers
Prepare optimizer and schedule (linear warmup and decay)
train/mrc_ner_trainer.py:107
Functionfind_data_instance
(file_path, search_string)
tests/illegal_entity_boundary.py:32
Methodforward
(self, sequence_pred_lst, sequence_gold_lst)
metrics/tagger_span_f1.py:14
Methodforward
(self, start_preds, end_preds, match_logits, start_label_mask, end_label_mask, match_labels)
metrics/query_span_f1.py:22
Methodforward
(self, input_features)
models/classifier.py:16
Methodforward
(self, input_features)
models/classifier.py:31
Methodforward
(self, input_features)
models/classifier.py:56
Methodforward
Args: input_ids: bert input tokens, tensor of shape [seq_len] token_type_ids: 0 for query, 1 for context, tensor of s
models/bert_query_ner.py:27
Methodforward
(self, input_ids, token_type_ids=None, attention_mask=None,)
models/bert_tagger.py:30
Methodforward
(self, input_ids, token_type_ids, attention_mask)
train/bert_tagger_trainer.py:147
Methodforward
(self, input_ids, attention_mask, token_type_ids)
train/mrc_ner_trainer.py:152
Functionremove_overlap
remove overlapped spans greedily for flat-ner Args: spans: list of tuple (start, end), which means [start, end] is a ner-span Ret
metrics/functional/query_span_f1.py:112
Functiontagger_collate_to_max_length
pad to maximum length of this batch Args: batch: a batch of samples, each contains a list of field data(Tensor): tokens,
datasets/collate_functions.py:10
Methodtest_dataloader
(self)
train/bert_tagger_trainer.py:245
Methodtest_dataloader
(self)
train/mrc_ner_trainer.py:323
Methodtest_epoch_end
(self, outputs)
train/bert_tagger_trainer.py:222
Methodtest_epoch_end
(self, outputs)
train/mrc_ner_trainer.py:305
next →1–100 of 111, ranked by callers