↓ 9 callersMethodencode_file(self, path, ordered=False, verbose=False, add_eos=True,
add_double_eos=False)
bert_read_step_to_step/transformers/tokenization_transfo_xl.py:176
↓ 6 callersMethod__init__(self, d_model, d_inner, dropout, pre_lnorm=False, layer_norm_epsilon=1e-5)
bert_read_step_to_step/transformers/modeling_transfo_xl.py:197
↓ 5 callersMethod__init__(self, params, lr=1e-3, betas=(0.9, 0.999), eps=1e-6, weight_decay=0.0, correct_bias=True)
bert_read_step_to_step/transformers/optimization.py:117
↓ 1 callersMethod_attn(self, q, k, v, attention_mask=None, head_mask=None)
bert_read_step_to_step/transformers/modeling_gpt2.py:143
↓ 1 callersMethod_attn(self, q, k, v, attention_mask=None, head_mask=None)
bert_read_step_to_step/transformers/modeling_openai.py:166