MCPcopy Create free account

hub / github.com/JaceyHuang/Gen3R / functions

Functions431 in github.com/JaceyHuang/Gen3R

↓ 1 callersFunction_geometry_adapter
Autoencoder3d adapted from Stable Diffusion 1.x, 2.x and XL.
gen3r/models/geometry_adapter/geometry_adapter.py:629
↓ 1 callersFunction_get_dataset_type_from_path
Determine dataset type from file path. Args: path: Path to the file dataset_names: List of dataset names to check agains
gen3r/utils/data_utils.py:71
↓ 1 callersMethod_get_intermediate_layers_chunked
(self, x, n=1)
gen3r/models/vggt/layers/vision_transformer.py:295
↓ 1 callersMethod_get_intermediate_layers_not_chunked
(self, x, n=1)
gen3r/models/vggt/layers/vision_transformer.py:283
↓ 1 callersMethod_init_step_index
Initialize the step_index counter for the scheduler.
gen3r/utils/fm_solvers.py:693
↓ 1 callersMethod_init_step_index
Initialize the step_index counter for the scheduler.
gen3r/utils/fm_solvers_unipc.py:643
↓ 1 callersFunction_make_scratch
(in_shape: List[int], out_shape: int, groups: int = 1, expand: bool = False)
gen3r/models/vggt/heads/dpt_head.py:340
↓ 1 callersMethod_norm
(self, x)
gen3r/models/videoxfun_wan/wan_transformer3d.py:416
↓ 1 callersMethod_process_frame_attention
Process frame attention blocks. We keep tokens in shape (B*S, P, C).
gen3r/models/vggt/models/aggregator.py:275
↓ 1 callersMethod_process_global_attention
Process global attention blocks. We keep tokens in shape (B, S*P, C).
gen3r/models/vggt/models/aggregator.py:296
↓ 1 callersMethod_relative_position_bucket
(self, rel_pos)
gen3r/models/videoxfun_wan/wan_text_encoder.py:238
↓ 1 callersMethod_rotate_features
Performs feature rotation by splitting and recombining feature dimensions. Args: x: Input tensor to rotate. Returns:
gen3r/models/vggt/layers/rope.py:120
↓ 1 callersFunction_sqrt_positive_part
Returns torch.sqrt(torch.max(0, x)) but with a zero subgradient where x is 0.
gen3r/models/vggt/utils/rotation.py:112
↓ 1 callersFunction_video_vae
Autoencoder3d adapted from Stable Diffusion 1.x, 2.x and XL.
gen3r/models/videoxfun_wan/wan_vae.py:603
↓ 1 callersFunctionactivate_head
Process network output to extract 3D points and confidence values. Args: out: Network output tensor (B, C, H, W) activation:
gen3r/models/vggt/heads/head_act.py:61
↓ 1 callersFunctionactivate_pose
Activate pose parameters with specified activation functions. Args: pred_pose_enc: Tensor containing encoded pose parameters [transl
gen3r/models/vggt/heads/head_act.py:12
↓ 1 callersFunctionadd_residual
(x, brange, residual, residual_scale_factor, scaling_vector=None)
gen3r/models/vggt/layers/block.py:148
↓ 1 callersFunctionbatch_encode_control_latents
(pixel_values, vggt, geo_adapter, wan_vae, clip_image_encoder, accelerator)
train_dit.py:490
↓ 1 callersFunctioncamera_loss_single
Computes translation, rotation, and focal loss for a batch of pose encodings. Args: pred_pose_enc: (N, D) predicted pose encodin
gen3r/utils/loss_utils.py:246
↓ 1 callersMethodcheck_inputs
( self, prompt, height, width, negative_prompt, callback_on_st
gen3r/pipeline/pipeline_gen3r.py:486
↓ 1 callersFunctionchoose_article
(word)
gen3r/utils/data_utils.py:106
↓ 1 callersFunctionclip_xlm_roberta_vit_h_14
( pretrained=False, pretrained_name='open-clip-xlm-roberta-large-vit-huge-14', **kwarg
gen3r/models/videoxfun_wan/wan_image_encoder.py:474
↓ 1 callersFunctionclosed_form_inverse_se3
Compute the inverse of each 4x4 (or 3x4) SE3 matrix in a batch. If `R` and `T` are provided, they must correspond to the rotation and transl
gen3r/models/vggt/utils/geometry.py:129
↓ 1 callersFunctioncolor_transfer
Transfer color distribution from of sc, referred to dc. Args: sc (numpy.ndarray): input image to be transfered. dc (numpy.nd
gen3r/utils/common_utils.py:21
↓ 1 callersMethodcompute_rel_l1_distance
(prev: torch.Tensor, cur: torch.Tensor)
gen3r/models/videoxfun_wan/cache_utils.py:62
↓ 1 callersFunctionconcat_pcd
(a: o3d.geometry.PointCloud, b: o3d.geometry.PointCloud)
gen3r/utils/common_utils.py:187
↓ 1 callersMethodconvert_model_output
Convert the model output to the corresponding type the DPMSolver/DPMSolver++ algorithm needs. DPM-Solver is designed to discretize an
gen3r/utils/fm_solvers.py:341
↓ 1 callersMethodconvert_model_output
r""" Convert the model output to the corresponding type the UniPC algorithm needs. Args: model_output (`torch.Tensor`):
gen3r/utils/fm_solvers_unipc.py:279
↓ 1 callersFunctionconvert_to_token_list
(latents: torch.Tensor, patch_size: int)
gen3r/utils/common_utils.py:116
↓ 1 callersFunctioncreate_dataset_config
Helper function to create dataset configs.
gen3r/utils/data_utils.py:30
↓ 1 callersFunctioncreate_uv_grid
Create a normalized UV grid of shape (width, height, 2). The grid spans horizontally and vertically according to an aspect ratio, ensuri
gen3r/models/vggt/heads/utils.py:65
↓ 1 callersFunctioncustom_mse_loss
(noise_pred, target, weighting=None, threshold=50)
train_dit.py:1599
↓ 1 callersMethoddecode
(self, z, scale)
gen3r/models/geometry_adapter/geometry_adapter.py:578
↓ 1 callersMethoddecode
(self, z: torch.Tensor, return_dict: bool = True)
gen3r/models/geometry_adapter/geometry_adapter.py:725
↓ 1 callersMethoddecode
(self, z, scale)
gen3r/models/videoxfun_wan/wan_vae.py:554
↓ 1 callersMethoddecode_latents
(self, latents: torch.Tensor, min_max_depth_mask=False)
gen3r/pipeline/pipeline_gen3r.py:438
↓ 1 callersFunctiondeepspeed_zero_init_disabled_context_manager
returns either a context list that includes one that will disable zero.Init or an empty context list
train_dit.py:1002
↓ 1 callersFunctiondepth_to_cam_coords_points
Convert a depth map to camera coordinates. Args: depth_map (np.ndarray): Depth map of shape (H, W). intrinsic (np.ndarray):
gen3r/models/vggt/utils/geometry.py:96
↓ 1 callersFunctiondepth_to_world_coords_points
Convert a depth map to world coordinates. Args: depth_map (np.ndarray): Depth map of shape (H, W). intrinsic (np.ndarray): C
gen3r/models/vggt/utils/geometry.py:50
↓ 1 callersMethoddpm_solver_first_order_update
One step for the first-order DPMSolver (equivalent to DDIM). Args: model_output (`torch.Tensor`): The dir
gen3r/utils/fm_solvers.py:415
↓ 1 callersFunctiondrop_path
(x, drop_prob: float = 0.0, training: bool = False)
gen3r/models/vggt/layers/drop_path.py:14
↓ 1 callersMethodencode
( self, x: torch.Tensor, return_dict: bool = True )
gen3r/models/geometry_adapter/geometry_adapter.py:704
↓ 1 callersMethodencode_control_image
(self, control_image)
gen3r/pipeline/pipeline_gen3r.py:408
↓ 1 callersMethodencode_prompt
r""" Encodes the prompt into text encoder hidden states. Args: prompt (`str` or `List[str]`, *optional*):
gen3r/pipeline/pipeline_gen3r.py:299
↓ 1 callersMethodforward
(self, x: Tensor, pos=None)
gen3r/models/vggt/layers/block.py:81
↓ 1 callersMethodforward
(self, x: Tensor, pos=None)
gen3r/models/vggt/layers/attention.py:50
↓ 1 callersMethodforward
r""" Args: x(Tensor): Shape [B, L1, C] e(Tensor): Shape [B, C]
gen3r/models/videoxfun_wan/wan_transformer3d.py:687
↓ 1 callersMethodforward_features
(self, x, masks=None)
gen3r/models/vggt/layers/vision_transformer.py:262
↓ 1 callersMethodforward_features_list
(self, x_list, masks_list)
gen3r/models/vggt/layers/vision_transformer.py:238
↓ 1 callersMethodforward_nested
x_list contains a list of tensors to nest together and run
gen3r/models/vggt/layers/block.py:211
↓ 1 callersFunctionget_1d_rotary_pos_embed_riflex
RIFLEx: Precompute the frequency tensor for complex exponentials (cis) with given dimensions. This function calculates a frequency tensor wi
gen3r/models/videoxfun_wan/wan_transformer3d.py:265
↓ 1 callersFunctionget_K
(w, h, fl_x, fl_y, cx, cy, width, height)
gen3r/utils/data_utils.py:528
↓ 1 callersFunctionget_branges_scales
(x, sample_drop_ratio=0.0)
gen3r/models/vggt/layers/block.py:140
↓ 1 callersFunctionget_noise_pred
( transformer3d, noisy_latent, # [B, 16, f, 70, 140] plucker_embeds, # [B, 24, f, H, W] t,
train_dit.py:529
↓ 1 callersFunctionget_poses
(cam_type='', num_frames=49, scene_scale=1.0)
infer.py:37
↓ 1 callersFunctionget_sampling_sigmas
(sampling_steps, shift)
gen3r/utils/fm_solvers.py:22
↓ 1 callersFunctionget_sigmas
(timesteps, scheduler, n_dim=4, dtype=torch.float32)
train_dit.py:1557
↓ 1 callersMethodinit_weights
(self)
gen3r/models/vggt/layers/vision_transformer.py:176
↓ 1 callersMethodinterpolate_pos_encoding
(self, x, w, h)
gen3r/models/vggt/layers/vision_transformer.py:183
↓ 1 callersFunctionmain
()
train_dit.py:880
↓ 1 callersFunctionmat_to_quat
Convert rotations given as rotation matrices to quaternions. Args: matrix: Rotation matrices as tensor of shape (..., 3, 3). Re
gen3r/models/vggt/utils/rotation.py:47
↓ 1 callersFunctionmodulate
Modulate the input tensor using scaling and shifting parameters.
gen3r/models/vggt/heads/camera_head.py:166
↓ 1 callersMethodmultistep_dpm_solver_second_order_update
One step for the second-order multistep DPMSolver. Args: model_output_list (`List[torch.Tensor]`): The di
gen3r/utils/fm_solvers.py:486
↓ 1 callersMethodmultistep_dpm_solver_third_order_update
One step for the third-order multistep DPMSolver. Args: model_output_list (`List[torch.Tensor]`): The dir
gen3r/utils/fm_solvers.py:596
↓ 1 callersMethodmultistep_uni_c_bh_update
One step for the UniC (B(h) version). Args: this_model_output (`torch.Tensor`): The model outputs at `x_
gen3r/utils/fm_solvers_unipc.py:486
↓ 1 callersMethodmultistep_uni_p_bh_update
One step for the UniP (B(h) version). Alternatively, `self.solver_p` is used if is specified. Args: model_output (`torch
gen3r/utils/fm_solvers_unipc.py:350
↓ 1 callersFunctionnamed_apply
(fn: Callable, module: nn.Module, name="", depth_first=True, include_root=False)
gen3r/models/vggt/layers/vision_transformer.py:24
↓ 1 callersFunctionparse_args
()
train_dit.py:552
↓ 1 callersFunctionparse_args
()
train_geo_adapter_pl.py:827
↓ 1 callersFunctionpos_interpolate
(pos, seq_len)
gen3r/models/videoxfun_wan/wan_image_encoder.py:25
↓ 1 callersFunctionposition_grid_to_embed
Convert 2D position grid (HxWx2) to sinusoidal embeddings (HxWxC) Args: pos_grid: Tensor of shape (H, W, 2) containing 2D coordinate
gen3r/models/vggt/heads/utils.py:11
↓ 1 callersMethodprepare_control_latents
( self, control_image, masks, dtype, device )
gen3r/pipeline/pipeline_gen3r.py:421
↓ 1 callersMethodprepare_extra_step_kwargs
(self, generator, eta)
gen3r/pipeline/pipeline_gen3r.py:468
↓ 1 callersMethodprepare_latents
( self, batch_size, num_channels_latents, num_frames, height, width, dtype, device, generator, latents
gen3r/pipeline/pipeline_gen3r.py:380
↓ 1 callersFunctionprepare_validation_data
(args, dataset_names, dataset_weights, num_selections)
train_dit.py:186
↓ 1 callersMethodpreprocess
Loads and preprocesses a video. Args: video_path: Path to the video file to load. Returns: torch.Te
gen3r/data/dataset.py:115
↓ 1 callersMethodpreprocess_cameras
Loads and preprocesses a camera path.
gen3r/data/dataset.py:132
↓ 1 callersFunctionquat_to_mat
Quaternion Order: XYZW or say ijkr, scalar-last Convert rotations given as quaternions to rotation matrices. Args: quaternions:
gen3r/models/vggt/utils/rotation.py:14
↓ 1 callersMethodreparameterize
(self, mu, log_var)
gen3r/models/geometry_adapter/geometry_adapter.py:606
↓ 1 callersMethodreparameterize
(self, mu, log_var)
gen3r/models/videoxfun_wan/wan_vae.py:581
↓ 1 callersMethodreset
(self)
gen3r/models/videoxfun_wan/cache_utils.py:67
↓ 1 callersFunctionrot_x
(theta)
infer.py:50
↓ 1 callersFunctionrot_y
(theta)
infer.py:45
↓ 1 callersMethodsave_pretrained_safetensors
(self, save_directory)
gen3r/models/geometry_adapter/geometry_adapter.py:768
↓ 1 callersFunctionsave_results
(args, results, prompts)
infer.py:90
↓ 1 callersFunctionsave_results
(args, results)
infer_geo_adapter.py:26
↓ 1 callersMethodscale_model_input
Ensures interchangeability with schedulers that need to scale the denoising model input depending on the current timestep. Ar
gen3r/utils/fm_solvers.py:800
↓ 1 callersMethodscratch_forward
Forward pass through the fusion blocks. Args: features (List[Tensor]): List of feature maps from different layers.
gen3r/models/vggt/heads/dpt_head.py:288
↓ 1 callersFunctionselect_prompts
Select prompts for validation with one fixed sample and the rest randomly sampled. Selection strategy: 1) Always select one prompt fro
gen3r/utils/data_utils.py:126
↓ 1 callersFunctionsinusoidal_embedding_1d
(dim, position)
gen3r/models/videoxfun_wan/wan_transformer3d.py:240
↓ 1 callersFunctionspectral_cmap
(x: torch.Tensor)
gen3r/utils/common_utils.py:94
↓ 1 callersFunctionstandardize_quaternion
Convert a unit quaternion to a standard form: one in which the real part is non negative. Args: quaternions: Quaternions with re
gen3r/models/vggt/utils/rotation.py:126
↓ 1 callersMethodstep
Predict the sample from the previous timestep by reversing the SDE. This function propagates the sample with the multistep UniPC.
gen3r/utils/fm_solvers_unipc.py:655
↓ 1 callersMethodtime_shift
(self, mu: float, sigma: float, t: torch.Tensor)
gen3r/utils/fm_solvers.py:337
↓ 1 callersMethodtime_shift
(self, mu: float, sigma: float, t: torch.Tensor)
gen3r/utils/fm_solvers_unipc.py:276
↓ 1 callersFunctiontorch_quantile
Better torch.quantile for one SCALAR quantile. Using torch.kthvalue. Better than torch.quantile because: - No 2**24 input size limit (pyt
gen3r/utils/loss_utils.py:107
↓ 1 callersFunctiontrain
(args)
train_geo_adapter_pl.py:756
↓ 1 callersMethodtrunk_fn
Iteratively refine camera pose predictions. Args: pose_tokens (torch.Tensor): Normalized camera tokens with shape [B, 1,
gen3r/models/vggt/heads/camera_head.py:114
↓ 1 callersMethodunpatchify
r""" Reconstruct video tensors from patch embeddings. Args: x (List[Tensor]): List of patchified features
gen3r/models/videoxfun_wan/wan_transformer3d.py:1130
↓ 1 callersMethodvideo_transform
Applies transformations to a video. Args: frames (torch.Tensor): A 4D tensor representing a video with s
gen3r/data/dataset.py:139
← previousnext →101–200 of 431, ranked by callers