MCPcopy Create free account
hub / github.com/google-research/language / encode

Method encode

language/serene/preprocessing.py:466–496  ·  view source on GitHub ↗

Encode the example using the input TF example. Args: claim: Claim text evidence: Evidence text claim_label: Claim verification label evidence_label: Label if is relevant evidence/claim metadata: Metadata about example wikipedia_url: wikipedia_ur

(claim, evidence, claim_label, evidence_label, metadata,
               wikipedia_url, sentence_id)

Source from the content-addressed store, hash-verified

464 def build_encoder_fn(self):
465
466 def encode(claim, evidence, claim_label, evidence_label, metadata,
467 wikipedia_url, sentence_id):
468 """Encode the example using the input TF example.
469
470 Args:
471 claim: Claim text
472 evidence: Evidence text
473 claim_label: Claim verification label
474 evidence_label: Label if is relevant evidence/claim
475 metadata: Metadata about example
476 wikipedia_url: wikipedia_url of example, or None
477 sentence_id: sentence_id of the example, or None
478
479 Returns:
480 Input fields of ClassicEmbedder model
481 """
482 claim_tokens, claim_word_ids, claim_mask, claim_segment_ids = self.encode(
483 claim.numpy())
484 evidence = create_evidence_input(
485 wikipedia_url.numpy().decode('utf8')
486 if self._include_title else None,
487 sentence_id.numpy().decode('utf8')
488 if self._include_sentence_id else None,
489 evidence.numpy().decode('utf8')
490 )
491
492 evidence_tokens, evidence_word_ids, evidence_mask, evidence_segment_ids = self.encode(
493 evidence)
494 return (claim_tokens, claim_word_ids, claim_mask, claim_segment_ids,
495 evidence_tokens, evidence_word_ids, evidence_mask,
496 evidence_segment_ids, claim_label, evidence_label, metadata)
497
498 def encode_map_fn(example):
499 """Read example from tfds and constructed named tensor inputs."""

Callers 15

encode_exampleMethod · 0.95
_decode_batch_input_fnFunction · 0.45
score_fileFunction · 0.45
_to_tf_exampleFunction · 0.45
process_tfrFunction · 0.45
mainFunction · 0.45
_convert_qa_pairsFunction · 0.45

Calls 6

_pad_or_truncate_pairMethod · 0.95
_pad_or_truncateMethod · 0.95
create_evidence_inputFunction · 0.85
decodeMethod · 0.45
tokenizeMethod · 0.45
convert_tokens_to_idsMethod · 0.45