Method__init__(self, d_model_size, num_heads, dff, rate=0.1, output_attentions=False)
bert_read_step_to_step/transformers/modeling_ctrl.py:138
Method__init__(self, vocab_file, merges_file, errors='replace', bos_token="<s>", eos_token="</s>", sep_token="</s>",
bert_read_step_to_step/transformers/tokenization_roberta.py:78
Method__init__(self, n_head, d_model, d_head, dropout, dropatt=0,
tgt_len=None, ext_len=None, mem_len=None,
bert_read_step_to_step/transformers/modeling_transfo_xl.py:233
Method__init__(self, n_head, d_model, d_head, d_inner, dropout, layer_norm_epsilon=1e-5,
**kwargs)
bert_read_step_to_step/transformers/modeling_transfo_xl.py:371
Method__init__(self, n_token, d_embed, d_proj, cutoffs, div_val=1,
sample_softmax=False)
bert_read_step_to_step/transformers/modeling_transfo_xl.py:394
Method__init__(self, vocab_file, merges_file, errors='replace', unk_token="<|endoftext|>",
bos_token="<|end
bert_read_step_to_step/transformers/tokenization_gpt2.py:116
Method__init__(self, special=None, min_freq=0, max_size=None, lower_case=False,
delimiter=None, vocab_file=
bert_read_step_to_step/transformers/tokenization_transfo_xl.py:73
Method__init__(self, paths, vocab, bsz, bptt, device='cpu', ext_len=None,
shuffle=False)
bert_read_step_to_step/transformers/tokenization_transfo_xl.py:411