MCPcopy Create free account

hub / github.com/TencentARC/Track4World / types & classes

Types & classes174 in github.com/TencentARC/Track4World

↓ 13 callersClassLayerScale
track4world/nets/external/pi3x/models/dinov2/layers/layer_scale.py:15
↓ 10 callersClassPermute
nn.Module wrapper around Tensor.permute for cleaner nn.Sequential usage.
track4world/nets/external/depth_anything_3/model/utils/head_utils.py:83
↓ 9 callersClassCNBlock1d
ConvNeXt-style block adapted for 1D sequences (Temporal). Can use Attention, MLP-Mixer, or 1D Convolutions.
track4world/nets/blocks.py:245
↓ 8 callersClassCNBlock2d
Standard ConvNeXt Block for 2D spatial processing.
track4world/nets/blocks.py:381
↓ 8 callersClassDropPath
Drop paths (Stochastic Depth) per sample (when applied in main path of residual blocks).
track4world/nets/external/pi3x/models/dinov2/layers/drop_path.py:26
↓ 7 callersClassBasicMotionEncoder
Encodes motion information by jointly processing: - Correlation volume (matching cost) - Current flow estimate (2D / 3D / high-dim pa
track4world/nets/blocks.py:1055
↓ 5 callersClassTransformerDecoder
track4world/nets/external/pi3x/models/layers/transformer_head.py:9
↓ 4 callersClassAutoRegistry
Registry that ensures all datasets are auto-discovered and imported on first use.
track4world/nets/external/depth_anything_3/bench/registries.py:64
↓ 4 callersClassDinoVisionTransformer
track4world/nets/dinov2/models/vision_transformer.py:44
↓ 4 callersClassDinoVisionTransformer
track4world/nets/external/pi3x/models/dinov2/models/vision_transformer.py:45
↓ 4 callersClassDinoVisionTransformer
track4world/nets/external/depth_anything_3/model/dinov2/vision_transformer.py:83
↓ 4 callersClassDropPath
Drop paths (Stochastic Depth) per sample (when applied in main path of residual blocks).
track4world/nets/dinov2/layers/drop_path.py:26
↓ 4 callersClassLayerScale
track4world/nets/dinov2/layers/layer_scale.py:15
↓ 3 callersClassAttnBlock
Block containing Self-Attention and MLP.
track4world/nets/blocks.py:689
↓ 3 callersClassBlockRope
track4world/nets/external/pi3x/models/layers/block.py:259
↓ 3 callersClassCNBlockConfig
Stores configuration for ConvNeXt blocks.
track4world/nets/blocks.py:429
↓ 3 callersClassCorrBlock
Correlation Block for RAFT-like architectures. Computes all-pairs correlation between fmap1 and fmap2 and builds a pyramid. Allows lookin
track4world/nets/blocks.py:124
↓ 3 callersClassGlobal_Aggregator
The Aggregator applies alternating-attention over input frames, as described in VGGT: Visual Geometry Grounded Transformer. Args:
track4world/nets/global_aggregator.py:18
↓ 3 callersClassInputPadder
Pads images such that dimensions are divisible by a certain stride (default 64). Useful for architectures that require specific input resolu
track4world/nets/blocks.py:37
↓ 2 callersClassCameraHead
track4world/nets/external/pi3x/models/layers/camera_head.py:32
↓ 2 callersClassColorMap2d
track4world/utils/improc.py:274
↓ 2 callersClassConvHead
track4world/nets/external/pi3x/models/layers/conv_head.py:62
↓ 2 callersClassCrossAttnBlock
Block containing Cross-Attention and MLP.
track4world/nets/blocks.py:641
↓ 2 callersClassDepthAnything3App
Main application class for Depth Anything 3 Gradio app.
track4world/nets/external/depth_anything_3/app/gradio_app.py:35
↓ 2 callersClassDropPath
Drop paths (Stochastic Depth) per sample (when applied in main path of residual blocks).
track4world/nets/external/depth_anything_3/model/dinov2/layers/drop_path.py:27
↓ 2 callersClassImage
track4world/nets/external/depth_anything_3/utils/read_write_model.py:50
↓ 2 callersClassInputProcessor
Prepares a batch of images for model inference. This processor converts a list of image file paths into a single, model-ready tensor. The proc
track4world/nets/external/depth_anything_3/utils/io/input_processor.py:35
↓ 2 callersClassLayerScale
track4world/nets/external/depth_anything_3/model/utils/attention.py:70
↓ 2 callersClassLayerScale
track4world/nets/external/depth_anything_3/model/dinov2/layers/layer_scale.py:14
↓ 2 callersClassLinearPts3d
Linear head for dust3r Each token outputs: - 16x16 3D points (+ confidence)
track4world/nets/external/pi3x/models/layers/transformer_head.py:58
↓ 2 callersClassMMPreNormResidual
track4world/nets/blocks.py:1020
↓ 2 callersClassMetricsPrinter
Beautiful tabular metrics printer with color support. Features: - Colorized best/worst values - Grouped by dataset and evaluation mo
track4world/nets/external/depth_anything_3/bench/print_metrics.py:94
↓ 2 callersClassMlp
MLP as used in Vision Transformer, MLP-Mixer and related networks
track4world/nets/blocks.py:571
↓ 2 callersClassPatchEmbed
2D image to patch embedding: (B,C,H,W) -> (B,N,D) Args: img_size: Image size. patch_size: Patch token size. in_chans
track4world/nets/external/pi3x/models/dinov2/layers/patch_embed.py:25
↓ 2 callersClassPositionGetter
return positions of patches
track4world/nets/external/pi3x/models/layers/pos_embed.py:162
↓ 2 callersClassResidualBlock
Standard ResNet Residual Block.
track4world/nets/blocks.py:732
↓ 2 callersClassResidualConvBlock
Standard Residual Convolutional Block with GroupNorm or LayerNorm. Consists of: Norm -> Activation -> Conv -> Norm -> Activation -> Conv.
track4world/nets/model.py:33
↓ 2 callersClassResidualConvBlock
track4world/nets/external/pi3x/models/layers/conv_head.py:25
↓ 2 callersClassResidualConvUnit
Lightweight residual convolution block for fusion
track4world/nets/external/depth_anything_3/model/dpt.py:379
↓ 2 callersClassRoPE2D
track4world/nets/external/pi3x/models/layers/pos_embed.py:112
↓ 2 callersClassVideoData
Dataclass for storing video tracks data.
track4world/utils/data.py:82
↓ 1 callersClassAttention
Standard Multi-Head Attention.
track4world/nets/blocks.py:609
↓ 1 callersClassBlinkvisionflowDataset
Dataset for loading BlinkVision flow data. Loads RGB images, depths, masks, and flow particles from .npz files.
evaluation/flow/eval.py:176
↓ 1 callersClassBlock
track4world/nets/external/depth_anything_3/model/utils/block.py:22
↓ 1 callersClassBlockChunk
track4world/nets/dinov2/models/vision_transformer.py:37
↓ 1 callersClassBlockChunk
track4world/nets/external/pi3x/models/dinov2/models/vision_transformer.py:38
↓ 1 callersClassContextOnlyTransformerDecoder
track4world/nets/external/pi3x/models/layers/transformer_head.py:85
↓ 1 callersClassConvNeXt
ConvNeXt Backbone implementation. Can initialize weights from torchvision's pre-trained models.
track4world/nets/blocks.py:452
↓ 1 callersClassCrossOnlyBlockRope
track4world/nets/external/pi3x/models/layers/block.py:475
↓ 1 callersClassEvaluator
Main evaluation orchestrator for DepthAnything3 benchmarks. Usage: evaluator = Evaluator( work_dir="./eval_workspace",
track4world/nets/external/depth_anything_3/bench/evaluator.py:41
↓ 1 callersClassEventHandlers
Handles all event callbacks and user interactions for the Gradio app.
track4world/nets/external/depth_anything_3/app/modules/event_handlers.py:35
↓ 1 callersClassFeatureFusionBlock
Top-down fusion block: (optional) residual merge + upsampling + 1x1 contraction
track4world/nets/external/depth_anything_3/model/dpt.py:407
↓ 1 callersClassFileHandler
Handles file uploads and processing for the Gradio app.
track4world/nets/external/depth_anything_3/app/modules/file_handlers.py:33
↓ 1 callersClassGaussians
3DGS parameters, all in world space
track4world/nets/external/depth_anything_3/specs.py:24
↓ 1 callersClassHead
Decoder Head for the Track4World model. Handles upsampling of features extracted from the backbone and projects them to generate geomet
track4world/nets/model.py:201
↓ 1 callersClassInferenceResponse
Response model for inference API.
track4world/nets/external/depth_anything_3/services/backend.py:65
↓ 1 callersClassInferenceService
Unified inference service class
track4world/nets/external/depth_anything_3/services/inference_service.py:28
↓ 1 callersClassKITTIDataset
Dataset loader for KITTI Scene Flow data stored in .npz format.
evaluation/flow/eval.py:114
↓ 1 callersClassKubric3DflowDataset
Dataset loader for Kubric 3D Flow data stored in .npz format.
evaluation/flow/eval.py:283
↓ 1 callersClassLogger
track4world/nets/external/depth_anything_3/utils/logger.py:37
↓ 1 callersClassMlp
track4world/nets/external/depth_anything_3/model/utils/attention.py:85
↓ 1 callersClassModelBackend
Model backend service with persistent model loading.
track4world/nets/external/depth_anything_3/services/backend.py:96
↓ 1 callersClassModelInference
Handles model inference and data processing for Depth Anything 3.
track4world/nets/external/depth_anything_3/app/modules/model_inference.py:34
↓ 1 callersClassOutputProcessor
Output processor for converting model outputs to Prediction objects. Handles tensor-to-numpy conversion, batch dimension removal, and cr
track4world/nets/external/depth_anything_3/utils/io/output_processor.py:31
↓ 1 callersClassPCARGBVisualizer
Stable PCA→RGB for video features shaped (T, H, W, D) or a single frame (H, W, D). - Global mean/V3 reference for stable colors - Per-fra
track4world/nets/external/depth_anything_3/utils/pca_utils.py:127
↓ 1 callersClassPoseInjectBlock
track4world/nets/external/pi3x/models/layers/block.py:412
↓ 1 callersClassPositionGetter
Generates and caches 2D spatial positions for patches in a grid. This class efficiently manages the generation of spatial coordinates for patches
track4world/nets/layers/rope.py:28
↓ 1 callersClassPositionGetter
Generates and caches 2D spatial positions for patches in a grid. This class efficiently manages the generation of spatial coordinates for patches
track4world/nets/external/depth_anything_3/model/dinov2/layers/rope.py:23
↓ 1 callersClassPrediction
track4world/nets/external/depth_anything_3/specs.py:35
↓ 1 callersClassRelUpdate3D
Relative Update Block for 3D flow / scene motion. Key characteristics: - Relative refinement of 3D motion fields - Multi-sou
track4world/nets/blocks.py:1524
↓ 1 callersClassRelUpdateBlock
Relative Update Block for 2D flow refinement. Core idea: - Update flow in a *relative* manner rather than absolute prediction
track4world/nets/blocks.py:1398
↓ 1 callersClassResConvBlock
1x1 convolution residual block
track4world/nets/external/pi3x/models/layers/camera_head.py:7
↓ 1 callersClassRotaryPositionEmbedding2D
2D Rotary Position Embedding implementation. This module applies rotary position embeddings to input tokens based on their 2D spatial positio
track4world/nets/layers/rope.py:80
↓ 1 callersClassRotaryPositionEmbedding2D
2D Rotary Position Embedding implementation. This module applies rotary position embeddings to input tokens based on their 2D spatial positio
track4world/nets/external/depth_anything_3/model/dinov2/layers/rope.py:63
↓ 1 callersClassTaskStatus
Task status model.
track4world/nets/external/depth_anything_3/services/backend.py:76
↓ 1 callersClassTrack4World
Track4World Model Implementation. Combines DINOv2 backbone for geometry estimation with a flow estimator (RAFT-like) for 4D (3D + Time) r
track4world/nets/model.py:584
↓ 1 callersClassTrackingEvalDataset
Dataset class for loading tracking evaluation data (ADT, DS, PO, etc.). Loads .npz files containing images, tracks, and camera parameters.
evaluation/track/eval.py:197
↓ 1 callersClassUIComponents
Handles UI component creation and layout for the Gradio app.
track4world/nets/external/depth_anything_3/app/modules/ui_components.py:28
↓ 1 callersClassVideo3DData
Dataclass for storing video tracks data.
track4world/utils/data.py:95
↓ 1 callersClassVisualizationHandler
Handles visualization updates and navigation for the Gradio app.
track4world/nets/external/depth_anything_3/app/modules/visualization.py:28
ClassAttention
track4world/nets/layers/attention.py:22
ClassAttention
track4world/nets/dinov2/layers/attention.py:36
ClassAttention
track4world/nets/external/pi3x/models/layers/attention.py:36
ClassAttention
track4world/nets/external/pi3x/models/dinov2/layers/attention.py:36
ClassAttention
track4world/nets/external/depth_anything_3/model/utils/attention.py:23
ClassAttention
track4world/nets/external/depth_anything_3/model/dinov2/layers/attention.py:18
ClassAttentionRope
track4world/nets/external/pi3x/models/layers/attention.py:238
ClassBasicEncoder
Basic ResNet-style encoder for feature extraction.
track4world/nets/blocks.py:795
ClassBasicUpdateBlock
GRU-like update block used in RAFT-style iterative flow refinement. Combines: - Previous flow features - Context features
track4world/nets/blocks.py:1119
ClassBlock
Standard Transformer block consisting of: - LayerNorm + Multi-Head Self-Attention - LayerNorm + Feed-Forward Network (MLP)
track4world/nets/layers/block.py:27
ClassBlock
track4world/nets/dinov2/layers/block.py:42
ClassBlock
track4world/nets/external/pi3x/models/layers/block.py:39
ClassBlock
track4world/nets/external/pi3x/models/dinov2/layers/block.py:42
ClassBlock
track4world/nets/external/depth_anything_3/model/dinov2/layers/block.py:26
ClassBlockChunk
track4world/nets/external/depth_anything_3/model/dinov2/vision_transformer.py:76
ClassCameraDec
track4world/nets/external/depth_anything_3/model/cam_dec.py:19
ClassCameraEnc
CameraHead predicts camera parameters from token representations using iterative refinement. It applies a series of transformer blocks (the
track4world/nets/external/depth_anything_3/model/cam_enc.py:23
ClassCenterPadding
track4world/nets/dinov2/hub/utils.py:23
ClassCenterPadding
track4world/nets/external/pi3x/models/dinov2/hub/utils.py:23
ClassCleanUpdateBlock
Clean and stabilized update block with LayerScale. Design goals: - Minimal, symmetric architecture - Stable deep refinement
track4world/nets/blocks.py:1321
next →1–100 of 174, ranked by callers