Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/PolyU-ChenLab/UniPixel
/ types & classes
Types & classes
99 in github.com/PolyU-ChenLab/UniPixel
⨍
Functions
437
◇
Types & classes
99
↓ 6 callers
Class
MLP
sam2/modeling/sam2_utils.py:109
↓ 5 callers
Class
LayerNorm2d
sam2/modeling/sam2_utils.py:137
↓ 4 callers
Class
Attention
An attention layer that allows for downscaling the size of the embedding after projection to queries, keys, and values.
sam2/modeling/sam/transformer.py:181
↓ 4 callers
Class
SafeInt
unipixel/eval/eval_general.py:9
↓ 4 callers
Class
Visualizer
Visualizer that draws data about detection/segmentation on images. It contains methods like `draw_{text,box,circle,line,binary_mask,polygon}
unipixel/utils/visualizer.py:255
↓ 3 callers
Class
MaskData
A structure for storing masks and their related data in batched format. Implements basic filtering and concatenation.
sam2/utils/amg.py:18
↓ 2 callers
Class
DropPath
sam2/modeling/sam2_utils.py:89
↓ 2 callers
Class
GenericMask
Attribute: polygons (list[ndarray]): list[ndarray]: polygons for this mask. Each ndarray has format [x, y, x, y, ...]
unipixel/utils/visualizer.py:80
↓ 2 callers
Class
Normalize
unipixel/utils/transforms.py:9
↓ 2 callers
Class
PromptEncoder
sam2/modeling/sam/prompt_encoder.py:16
↓ 2 callers
Class
Resize
unipixel/utils/transforms.py:21
↓ 2 callers
Class
RoPEAttention
Attention with rotary position encoding.
sam2/modeling/sam/transformer.py:240
↓ 2 callers
Class
ToTensor
unipixel/utils/transforms.py:27
↓ 1 callers
Class
AsyncVideoFrameLoader
A list of video frames to be load asynchronously without blocking session start.
sam2/utils/misc.py:104
↓ 1 callers
Class
BatchedVideoDatapoint
This class represents a batch of videos with associated annotations. Attributes: img_batch: A [TxBxCxHxW] tensor containing the image
sam2/sam2_train.py:20
↓ 1 callers
Class
CXBlock
r"""ConvNeXt Block. There are two equivalent implementations: (1) DwConv -> LayerNorm (channels_first) -> 1x1 Conv -> GELU -> 1x1 Conv; all in (N,
sam2/modeling/memory_encoder.py:61
↓ 1 callers
Class
ChunkStoppingCallback
unipixel/train/custom_trainer.py:98
↓ 1 callers
Class
Conversation
unipixel/conversation.py:8
↓ 1 callers
Class
CustomTrainer
unipixel/train/custom_trainer.py:116
↓ 1 callers
Class
EvalDataset
unipixel/eval/infer_seg.py:76
↓ 1 callers
Class
GroupSampler
unipixel/train/custom_trainer.py:57
↓ 1 callers
Class
HybridDataCollator
unipixel/dataset/collator.py:11
↓ 1 callers
Class
HybridDataset
unipixel/dataset/hybrid.py:19
↓ 1 callers
Class
MaskDecoder
sam2/modeling/sam/mask_decoder.py:15
↓ 1 callers
Class
MemoryAttentionLayer
sam2/modeling/memory_attention.py:17
↓ 1 callers
Class
MultiScaleAttention
sam2/modeling/backbones/hieradet.py:39
↓ 1 callers
Class
MultiScaleBlock
sam2/modeling/backbones/hieradet.py:85
↓ 1 callers
Class
MultiStepMultiMasksAndIous
sam2/loss_fns.py:121
↓ 1 callers
Class
PatchEmbed
Image to Patch Embedding.
sam2/modeling/backbones/utils.py:60
↓ 1 callers
Class
PixelQwen2_5_VLModel
unipixel/model/qwen2_5_vl.py:43
↓ 1 callers
Class
PositionEmbedding1DRandom
Positional encoding using random frequencies for 1D inputs.
sam2/modeling/position_encoding.py:192
↓ 1 callers
Class
PositionEmbeddingRandom
Positional encoding using random spatial frequencies.
sam2/modeling/position_encoding.py:134
↓ 1 callers
Class
REFER
unipixel/dataset/sub_classes/utils.py:10
↓ 1 callers
Class
SAM2ImagePredictor
sam2/sam2_image_predictor.py:20
↓ 1 callers
Class
SAM2Transforms
sam2/utils/transforms.py:15
↓ 1 callers
Class
TwoWayAttentionBlock
sam2/modeling/sam/transformer.py:110
↓ 1 callers
Class
TwoWayTransformer
sam2/modeling/sam/transformer.py:19
↓ 1 callers
Class
VisImage
unipixel/utils/visualizer.py:177
Class
ADE20KDataset
unipixel/dataset/sub_classes/segmentation.py:855
Class
COCOStuffDataset
unipixel/dataset/sub_classes/segmentation.py:911
Class
ColorMode
Enum of different color modes to use for instance visualizations.
unipixel/utils/visualizer.py:58
Class
DataArguments
unipixel/train/train.py:38
Class
FpnNeck
A modified variant of Feature Pyramid Network (FPN) neck (we remove output conv and also do bicubic interpolation similar to ViT pos embe
sam2/modeling/backbones/image_encoder.py:58
Class
Fuser
sam2/modeling/memory_encoder.py:117
Class
GroundMoReDataset
unipixel/dataset/sub_classes/segmentation.py:627
Class
Hiera
Reference: https://arxiv.org/abs/2306.00989
sam2/modeling/backbones/hieradet.py:179
Class
ImageEncoder
sam2/modeling/backbones/image_encoder.py:14
Class
InstITImageShortCaptionRawRefDataset
unipixel/dataset/sub_classes/referring.py:299
Class
InstITVideoQARawDataset
unipixel/dataset/sub_classes/region.py:378
Class
InstITVideoQARawMemDataset
unipixel/dataset/sub_classes/memory.py:326
Class
LVVISDataset
unipixel/dataset/sub_classes/segmentation.py:401
Class
LlavaVideoGPTPlusDataset
unipixel/dataset/sub_classes/multimodal.py:102
Class
MVBenchDataset
unipixel/dataset/sub_classes/evaluation/mvbench.py:11
Class
MapillaryDataset
unipixel/dataset/sub_classes/segmentation.py:950
Class
MaskDownSampler
Progressively downsample a mask by total_stride, each time by stride. Note that LayerNorm is applied per *token*, like in ViT. With each
sam2/modeling/memory_encoder.py:17
Class
MeViSDataset
unipixel/dataset/sub_classes/segmentation.py:336
Class
MemoryAttention
sam2/modeling/memory_attention.py:102
Class
MemoryDataset
unipixel/dataset/sub_classes/memory.py:33
Class
MemoryEncoder
sam2/modeling/memory_encoder.py:138
Class
ModelArguments
unipixel/train/train.py:21
Class
MultimodalDataset
unipixel/dataset/sub_classes/multimodal.py:11
Class
OspreyConversationDataset
unipixel/dataset/sub_classes/region.py:486
Class
OspreyDetailDescriptionDataset
unipixel/dataset/sub_classes/region.py:588
Class
OspreyPosNegDataset
unipixel/dataset/sub_classes/region.py:578
Class
PACOLVISDataset
unipixel/dataset/sub_classes/segmentation.py:991
Class
PASCALPartDataset
unipixel/dataset/sub_classes/segmentation.py:1057
Class
PatchedQwen2_5_VLProcessor
unipixel/model/qwen2_5_vl.py:25
Class
PixelQwen2_5_VLConfig
unipixel/model/qwen2_5_vl.py:32
Class
PixelQwen2_5_VLForConditionalGeneration
unipixel/model/qwen2_5_vl.py:55
Class
PixelQwen2_5_VisionTransformerPretrainedModel
unipixel/model/qwen2_5_vl.py:36
Class
PositionEmbeddingSine
This is a more standard version of the position embedding, very similar to the one used by the Attention Is All You Need paper, generalized t
sam2/modeling/position_encoding.py:15
Class
ReSAVEvalDataset
unipixel/dataset/sub_classes/evaluation/ref_sav.py:12
Class
ReVOSDataset
unipixel/dataset/sub_classes/segmentation.py:250
Class
ReasonSegDataset
unipixel/dataset/sub_classes/segmentation.py:782
Class
RefCOCODataset
unipixel/dataset/sub_classes/segmentation.py:1067
Class
RefCOCOGDataset
unipixel/dataset/sub_classes/segmentation.py:1138
Class
RefCOCOPlusDataset
unipixel/dataset/sub_classes/segmentation.py:1129
Class
RefClefDataset
unipixel/dataset/sub_classes/segmentation.py:1147
Class
RefDAVIS17Dataset
unipixel/dataset/sub_classes/segmentation.py:517
Class
RefSAVDataset
unipixel/dataset/sub_classes/segmentation.py:576
Class
RefYouTubeVOSDataset
unipixel/dataset/sub_classes/segmentation.py:461
Class
ReferringDataset
unipixel/dataset/sub_classes/referring.py:50
Class
RegionDataset
unipixel/dataset/sub_classes/region.py:54
Class
SAM2AutomaticMaskGenerator
sam2/automatic_mask_generator.py:22
Class
SAM2Base
sam2/modeling/sam2_base.py:21
Class
SAM2Train
sam2/sam2_train.py:65
Class
SAM2VideoPredictor
The predictor class to handle user interactions and manage inference states.
sam2/sam2_video_predictor.py:17
Class
SAM2VideoPredictorVOS
Optimized for the VOS setting
sam2/sam2_video_predictor.py:1034
Class
SegmentationDataset
unipixel/dataset/sub_classes/segmentation.py:85
Class
TrainingArguments
unipixel/train/train.py:57
Class
ViCaSDataset
unipixel/dataset/sub_classes/segmentation.py:707
Class
VideoMMEDataset
unipixel/dataset/sub_classes/evaluation/videomme.py:12
Class
VideoReferBenchDDataset
unipixel/dataset/sub_classes/evaluation/videorefer.py:101
Class
VideoReferBenchQDataset
unipixel/dataset/sub_classes/evaluation/videorefer.py:13
Class
VideoReferDetailedCaptionDataset
unipixel/dataset/sub_classes/region.py:358
Class
VideoReferQADataset
unipixel/dataset/sub_classes/region.py:368
Class
VideoReferQAMemDataset
unipixel/dataset/sub_classes/memory.py:216
Class
VideoReferShortCaptionDataset
unipixel/dataset/sub_classes/region.py:268
Class
VideoReferShortCaptionRefDataset
unipixel/dataset/sub_classes/referring.py:231