↓ 1 callersFunctionbeam_search(model, prompts=None, tokens_to_generate=0, beam_size=0, add_BOS=False, stop_token=50256, num_return_gen=1, le
pretrain/megatron/inference/text_generation/api.py:184
↓ 1 callersFunctionbeam_search_and_return_on_first_stage(model, tokens, lengths, beam_size, stop_token, num_return_gen, length_penalty, prevent_newline_after_colon=Tr
pretrain/megatron/inference/text_generation/generation.py:291
↓ 1 callersMethodbert_extended_attention_maskCreates the extended attention mask Converts the attention mask of dimension [batch size, 1, seq len] to [batch size, 1, seq len, seq len] an
pretrain/megatron/core/models/bert/bert_model.py:143
↓ 1 callersFunctioncosine_scheduler(base_value, final_value, epochs, niter_per_ep,
warmup_epochs=0, start_warmup_value=0)
pretrain/megatron/legacy/model/vision/dino.py:159