↓ 1 callersMethod_prepare_4d_causal_attention_mask_with_cache_position Creates a causal 4D mask of shape `(batch_size, 1, query_length, key_value_length)` from a 2D mask of shape `(batch_size, key_value_l
vita_audio/models/qwen2_mtp_sensevoice_v4_48_3/modeling_qwen2.py:775
↓ 1 callersFunctionbuild_supervised_dataset_deepspeed(
model_config,
model_args,
data_args,
training_args,
tokenizer,
create_position_ids=T
vita_audio/data/build.py:23
↓ 1 callersFunctioninference(model, tokenizer, audio_tokenizer, dataloader, output_dir, asr_model)
evaluation/evaluate_libritts.py:109
↓ 1 callersFunctioninference(model, tokenizer, audio_tokenizer, dataloader, output_dir, asr_model)
evaluation/evaluate_sqa.py:155