↓ 6 callersFunctiondownsample_and_save_pointcloud(filename, point_maps, rgbs, voxel_size=0.005, filter_outliers=True, depth_percentile=0, remove_far_points=Fal
gen3r/utils/common_utils.py:134
↓ 6 callersFunctionsave_videos_grid(videos: torch.Tensor, path: str, rescale=False, n_rows=6, fps=12, imageio_backend=True, color_transfer_post_p
gen3r/utils/common_utils.py:49
↓ 5 callersFunctionattention(
q,
k,
v,
q_lens=None,
k_lens=None,
dropout_p=0.,
softmax_scale=None,
q_scale
gen3r/models/videoxfun_wan/wan_transformer3d.py:175
↓ 3 callersMethodget_aggregated_token_list(self, reconstructed_cam_tokens, reconstructed_image_tokens, target_cam_tokens, target_tokens_list, ps_idx, B,
train_geo_adapter_pl.py:231
↓ 3 callersFunctionlog_validation(
args, config, vggt, geo_adapter, wan_vae, text_encoder, tokenizer, transformer3d_or_path, clip_image_enc
train_dit.py:200
↓ 2 callersFunctionflash_attention q: [B, Lq, Nq, C1]. k: [B, Lk, Nk, C1]. v: [B, Lk, Nk, C2]. Nq must be divisible by Nk. q_lens
gen3r/models/videoxfun_wan/wan_transformer3d.py:66
↓ 2 callersFunctionpreprocess_cameras(
camera_path: Path,
max_num_frames: int,
height: int,
width: int,
interval: int = 2,
gen3r/utils/data_utils.py:282
↓ 1 callersMethod__init__(self, base_path, num_frames=49, frame_interval=1, height=560, width=560, split='train')
train_geo_adapter_pl.py:40
↓ 1 callersMethod__init__(self, in_dim, out_dim, kernel_size, stride, num_residual_blocks=1)
gen3r/models/videoxfun_wan/wan_camera_adapter.py:5