Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/bytedance/LatentSync
/ types & classes
Types & classes
103 in github.com/bytedance/LatentSync
⨍
Functions
512
◇
Types & classes
103
↓ 37 callers
Class
Conv2d
latentsync/models/wav2lip_syncnet.py:71
↓ 7 callers
Class
InflatedConv3d
latentsync/models/resnet.py:10
↓ 6 callers
Class
Linear
latentsync/whisper/whisper/model.py:34
↓ 6 callers
Class
ResnetBlock3D
latentsync/models/resnet.py:104
↓ 5 callers
Class
LayerNorm
latentsync/whisper/whisper/model.py:29
↓ 5 callers
Class
PretrainVisionTransformer
Vision Transformer with support for patch or hybrid CNN input stage
latentsync/trepa/third_party/VideoMAEv2/videomaev2_pretrain.py:238
↓ 5 callers
Class
TargetFC
Fully connection operations for target net Note: Weights & biases are different for different images in a batch, thus here w
eval/hyper_iqa.py:158
↓ 4 callers
Class
ImageProcessor
latentsync/utils/image_processor.py:34
↓ 3 callers
Class
Attention
latentsync/models/attention.py:202
↓ 3 callers
Class
Audio2Feature
latentsync/whisper/audio2feature.py:10
↓ 3 callers
Class
Block
latentsync/trepa/third_party/VideoMAEv2/videomaev2_finetune.py:261
↓ 3 callers
Class
InflatedGroupNorm
latentsync/models/resnet.py:21
↓ 3 callers
Class
L2Norm
eval/detectors/s3fd/nets.py:8
↓ 3 callers
Class
StableSyncNet
latentsync/models/stable_syncnet.py:28
↓ 3 callers
Class
SyncNetDataset
latentsync/data/syncnet_dataset.py:29
↓ 3 callers
Class
SyncNetDetector
eval/syncnet_detect.py:20
↓ 3 callers
Class
SyncNetEval
eval/syncnet/syncnet_eval.py:40
↓ 3 callers
Class
Transformer3DModel
latentsync/models/attention.py:23
↓ 2 callers
Class
Conv1d
latentsync/whisper/whisper/model.py:41
↓ 2 callers
Class
DecodingResult
latentsync/whisper/whisper/decoding.py:104
↓ 2 callers
Class
DownEncoder2D
latentsync/models/stable_syncnet.py:172
↓ 2 callers
Class
Downsample3D
latentsync/models/resnet.py:78
↓ 2 callers
Class
LipsyncPipeline
latentsync/pipelines/lipsync_pipeline.py:43
↓ 2 callers
Class
MultiHeadAttention
latentsync/whisper/whisper/model.py:57
↓ 2 callers
Class
PatchEmbed
Image to Patch Embedding
latentsync/trepa/third_party/VideoMAEv2/videomaev2_finetune.py:323
↓ 2 callers
Class
ResidualAttentionBlock
latentsync/whisper/whisper/model.py:103
↓ 2 callers
Class
TREPALoss
latentsync/trepa/loss.py:22
↓ 2 callers
Class
Upsample3D
latentsync/models/resnet.py:32
↓ 2 callers
Class
VideoProcessor
latentsync/utils/image_processor.py:103
↓ 1 callers
Class
AVReader
Individual audio video reader with convenient indexing function. Parameters ---------- uri: str Path of file. ctx: decord.Con
latentsync/utils/av_reader.py:13
↓ 1 callers
Class
AlignRestore
latentsync/utils/affine_transform.py:10
↓ 1 callers
Class
ApplyTimestampRules
latentsync/whisper/whisper/decoding.py:405
↓ 1 callers
Class
Attention
latentsync/trepa/third_party/VideoMAEv2/videomaev2_finetune.py:210
↓ 1 callers
Class
AttentionBlock2D
latentsync/models/stable_syncnet.py:136
↓ 1 callers
Class
AudioEncoder
latentsync/whisper/whisper/model.py:131
↓ 1 callers
Class
BasicTransformerBlock
latentsync/models/attention.py:127
↓ 1 callers
Class
BeamSearchDecoder
latentsync/whisper/whisper/decoding.py:281
↓ 1 callers
Class
Chart
eval/draw_syncnet_lines.py:19
↓ 1 callers
Class
CosAttention
latentsync/trepa/third_party/VideoMAEv2/videomaev2_finetune.py:154
↓ 1 callers
Class
CrossAttnDownBlock3D
latentsync/models/unet_blocks.py:263
↓ 1 callers
Class
CrossAttnUpBlock3D
latentsync/models/unet_blocks.py:519
↓ 1 callers
Class
DecodingOptions
latentsync/whisper/whisper/decoding.py:72
↓ 1 callers
Class
DecodingTask
latentsync/whisper/whisper/decoding.py:444
↓ 1 callers
Class
Detect
eval/detectors/s3fd/box_utils.py:133
↓ 1 callers
Class
DownBlock3D
latentsync/models/unet_blocks.py:410
↓ 1 callers
Class
DropPath
Drop paths (Stochastic Depth) per sample (when applied in main path of residual blocks).
latentsync/trepa/third_party/VideoMAEv2/videomaev2_finetune.py:119
↓ 1 callers
Class
EnglishNumberNormalizer
Convert any spelled-out numbers into arabic numbers, while handling: - remove any commas - keep the suffixes such as: `1960s`, `274th`,
latentsync/whisper/whisper/normalizers/english.py:12
↓ 1 callers
Class
EnglishSpellingNormalizer
Applies British-American spelling mappings as listed in [1]. [1] https://www.tysto.com/uk-us-spelling-list.html
latentsync/whisper/whisper/normalizers/english.py:443
↓ 1 callers
Class
FVD
eval/eval_fvd.py:25
↓ 1 callers
Class
FaceDetector
latentsync/utils/face_detector.py:8
↓ 1 callers
Class
FaceDetector
preprocess/filter_high_resolution.py:37
↓ 1 callers
Class
FaceDetector
preprocess/remove_incorrect_affined.py:22
↓ 1 callers
Class
FeatureStats
Class to store statistics of features, including all features and mean/covariance. Args: capture_all: Whether to store all the featu
latentsync/trepa/utils/metric_utils.py:18
↓ 1 callers
Class
FileslistWriter
tools/write_fileslist.py:19
↓ 1 callers
Class
GreedyDecoder
latentsync/whisper/whisper/decoding.py:253
↓ 1 callers
Class
HyperNet
Hyper network for learning perceptual rules. Args: lda_out_channels: local distortion aware module output size. hyper_in_cha
eval/hyper_iqa.py:19
↓ 1 callers
Class
MaximumLikelihoodRanker
Select the sample with the highest log probabilities, penalized using either a simple length normalization or Google NMT paper's length penal
latentsync/whisper/whisper/decoding.py:173
↓ 1 callers
Class
Mish
latentsync/models/resnet.py:226
↓ 1 callers
Class
Mlp
latentsync/trepa/third_party/VideoMAEv2/videomaev2_finetune.py:133
↓ 1 callers
Class
ModelDimensions
latentsync/whisper/whisper/model.py:16
↓ 1 callers
Class
PositionalEncoding
latentsync/models/motion_module.py:221
↓ 1 callers
Class
PretrainVisionTransformerDecoder
Vision Transformer with support for patch or hybrid CNN input stage
latentsync/trepa/third_party/VideoMAEv2/videomaev2_pretrain.py:146
↓ 1 callers
Class
PretrainVisionTransformerEncoder
Vision Transformer with support for patch or hybrid CNN input stage
latentsync/trepa/third_party/VideoMAEv2/videomaev2_pretrain.py:27
↓ 1 callers
Class
PriorBox
eval/detectors/s3fd/box_utils.py:180
↓ 1 callers
Class
PyTorchInference
latentsync/whisper/whisper/decoding.py:132
↓ 1 callers
Class
ResNetBackbone
eval/hyper_iqa.py:220
↓ 1 callers
Class
Resize
latentsync/trepa/third_party/VideoMAEv2/utils.py:31
↓ 1 callers
Class
ResnetBlock2D
latentsync/models/stable_syncnet.py:65
↓ 1 callers
Class
S
eval/syncnet/syncnet.py:18
↓ 1 callers
Class
S3FD
eval/detectors/s3fd/__init__.py:14
↓ 1 callers
Class
S3FDNet
eval/detectors/s3fd/nets.py:28
↓ 1 callers
Class
SuppressBlank
latentsync/whisper/whisper/decoding.py:387
↓ 1 callers
Class
SuppressTokens
latentsync/whisper/whisper/decoding.py:397
↓ 1 callers
Class
TargetNet
Target network for quality prediction.
eval/hyper_iqa.py:123
↓ 1 callers
Class
TemporalTransformer3DModel
latentsync/models/motion_module.py:76
↓ 1 callers
Class
TemporalTransformerBlock
latentsync/models/motion_module.py:154
↓ 1 callers
Class
TextDecoder
latentsync/whisper/whisper/model.py:174
↓ 1 callers
Class
ToFloatTensorInZeroOne
latentsync/trepa/third_party/VideoMAEv2/utils.py:26
↓ 1 callers
Class
Tokenizer
A thin wrapper around `GPT2TokenizerFast` providing quick access to special tokens
latentsync/whisper/whisper/tokenizer.py:130
↓ 1 callers
Class
Transformer3DModelOutput
latentsync/models/attention.py:19
↓ 1 callers
Class
UNet3DConditionOutput
latentsync/models/unet.py:35
↓ 1 callers
Class
UNetDataset
latentsync/data/unet_dataset.py:29
↓ 1 callers
Class
UNetMidBlock3DCrossAttn
latentsync/models/unet_blocks.py:153
↓ 1 callers
Class
UpBlock3D
latentsync/models/unet_blocks.py:669
↓ 1 callers
Class
VanillaTemporalModule
latentsync/models/motion_module.py:39
↓ 1 callers
Class
VersatileAttention
latentsync/models/motion_module.py:237
↓ 1 callers
Class
VideoData
Class to create dataloaders for video datasets Args: data_path: Path to the folder with video frames or videos. image_folder: I
latentsync/trepa/utils/data_utils.py:77
↓ 1 callers
Class
VisionTransformer
Vision Transformer with support for patch or hybrid CNN input stage
latentsync/trepa/third_party/VideoMAEv2/videomaev2_finetune.py:371
↓ 1 callers
Class
Whisper
latentsync/whisper/whisper/model.py:220
↓ 1 callers
Class
dummy_context
latentsync/utils/util.py:284
Class
BasicTextNormalizer
latentsync/whisper/whisper/normalizers/basic.py:55
Class
Bottleneck
eval/hyper_iqa.py:181
Class
EnglishTextNormalizer
latentsync/whisper/whisper/normalizers/english.py:458
Class
FrameDataset
Generic dataset for videos stored as images. The loading will iterates over all the folders and subfolders in the provided directory. Ea
latentsync/trepa/utils/data_utils.py:211
Class
Inference
latentsync/whisper/whisper/decoding.py:118
Class
LogitFilter
latentsync/whisper/whisper/decoding.py:371
Class
Predictor
predict.py:21
Class
SequenceRanker
latentsync/whisper/whisper/decoding.py:164
Class
TemporalTransformer3DModelOutput
latentsync/models/motion_module.py:25
Class
TokenDecoder
latentsync/whisper/whisper/decoding.py:199
next →
1–100 of 103, ranked by callers