Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/antgroup/echomimic
/ types & classes
Types & classes
83 in github.com/antgroup/echomimic
⨍
Functions
352
◇
Types & classes
83
↓ 2,688 callers
Class
Connection
The connection class for face landmarks.
src/utils/face_landmark.py:127
↓ 13 callers
Class
InflatedConv3d
src/models/resnet.py:9
↓ 8 callers
Class
ReferenceAttentionControl
src/models/mutual_self_attention.py:19
↓ 6 callers
Class
Linear
src/models/whisper/whisper/model.py:34
↓ 6 callers
Class
ResnetBlock3D
src/models/resnet.py:123
↓ 5 callers
Class
FaceLandmarkerResult
The face landmarks detection result from FaceLandmarker, where each vector element represents a single face detected in the image. Attributes:
src/utils/face_landmark.py:2859
↓ 5 callers
Class
FaceLocator
src/models/face_locator.py:12
↓ 5 callers
Class
LayerNorm
src/models/whisper/whisper/model.py:29
↓ 4 callers
Class
InflatedGroupNorm
src/models/resnet.py:20
↓ 3 callers
Class
FaceMeshVisualizer
src/utils/draw_utils.py:6
↓ 3 callers
Class
Transformer2DModel
A 2D Transformer model for image-like data. Parameters: num_attention_heads (`int`, *optional*, defaults to 16): The number of heads
src/models/transformer_2d.py:32
↓ 3 callers
Class
Transformer3DModel
src/models/transformer_3d.py:27
↓ 2 callers
Class
Audio2Feature
src/models/whisper/audio2feature.py:8
↓ 2 callers
Class
Audio2VideoPipeline
src/pipelines/pipeline_echo_mimic.py:43
↓ 2 callers
Class
Conv1d
src/models/whisper/whisper/model.py:41
↓ 2 callers
Class
DecodingResult
src/models/whisper/whisper/decoding.py:104
↓ 2 callers
Class
Downsample3D
src/models/resnet.py:93
↓ 2 callers
Class
LMKExtractor
src/utils/mp_utils.py:19
↓ 2 callers
Class
MultiHeadAttention
src/models/whisper/whisper/model.py:57
↓ 2 callers
Class
ResidualAttentionBlock
src/models/whisper/whisper/model.py:103
↓ 2 callers
Class
UNetMidBlock3DCrossAttn
src/models/unet_3d_blocks.py:171
↓ 2 callers
Class
Upsample3D
src/models/resnet.py:31
↓ 1 callers
Class
ApplyTimestampRules
src/models/whisper/whisper/decoding.py:405
↓ 1 callers
Class
Audio2VideoPipeline
src/pipelines/pipeline_echo_mimic_acc.py:44
↓ 1 callers
Class
Audio2VideoPipelineOutput
src/pipelines/pipeline_echo_mimic.py:39
↓ 1 callers
Class
Audio2VideoPipelineOutput
src/pipelines/pipeline_echo_mimic_acc.py:40
↓ 1 callers
Class
AudioEncoder
src/models/whisper/whisper/model.py:131
↓ 1 callers
Class
AudioPose2VideoPipeline
src/pipelines/pipeline_echo_mimic_pose.py:35
↓ 1 callers
Class
AudioPose2VideoPipeline
src/pipelines/pipeline_echo_mimic_pose_acc.py:36
↓ 1 callers
Class
AudioPose2VideoPipelineOutput
src/pipelines/pipeline_echo_mimic_pose.py:31
↓ 1 callers
Class
AudioPose2VideoPipelineOutput
src/pipelines/pipeline_echo_mimic_pose_acc.py:32
↓ 1 callers
Class
BasicTransformerBlock
r""" A basic Transformer block. Parameters: dim (`int`): The number of channels in the input and output. num_attention_heads
src/models/attention.py:12
↓ 1 callers
Class
BeamSearchDecoder
src/models/whisper/whisper/decoding.py:281
↓ 1 callers
Class
CrossAttnDownBlock2D
src/models/unet_2d_blocks.py:510
↓ 1 callers
Class
CrossAttnDownBlock3D
src/models/unet_3d_blocks.py:298
↓ 1 callers
Class
CrossAttnUpBlock2D
src/models/unet_2d_blocks.py:779
↓ 1 callers
Class
CrossAttnUpBlock3D
src/models/unet_3d_blocks.py:591
↓ 1 callers
Class
DecodingOptions
src/models/whisper/whisper/decoding.py:72
↓ 1 callers
Class
DecodingTask
src/models/whisper/whisper/decoding.py:444
↓ 1 callers
Class
DownBlock2D
src/models/unet_2d_blocks.py:681
↓ 1 callers
Class
DownBlock3D
src/models/unet_3d_blocks.py:472
↓ 1 callers
Class
EnglishNumberNormalizer
Convert any spelled-out numbers into arabic numbers, while handling: - remove any commas - keep the suffixes such as: `1960s`, `274th`,
src/models/whisper/whisper/normalizers/english.py:12
↓ 1 callers
Class
EnglishSpellingNormalizer
Applies British-American spelling mappings as listed in [1]. [1] https://www.tysto.com/uk-us-spelling-list.html
src/models/whisper/whisper/normalizers/english.py:443
↓ 1 callers
Class
FaceLandmarkerOptions
Options for the face landmarker task. Attributes: base_options: Base options for the face landmarker task. running_mode: The running mode o
src/utils/face_landmark.py:2996
↓ 1 callers
Class
GreedyDecoder
src/models/whisper/whisper/decoding.py:253
↓ 1 callers
Class
MaximumLikelihoodRanker
Select the sample with the highest log probabilities, penalized using either a simple length normalization or Google NMT paper's length penal
src/models/whisper/whisper/decoding.py:173
↓ 1 callers
Class
Mish
src/models/resnet.py:250
↓ 1 callers
Class
ModelDimensions
src/models/whisper/whisper/model.py:16
↓ 1 callers
Class
PositionalEncoding
src/models/motion_module.py:262
↓ 1 callers
Class
PyTorchInference
src/models/whisper/whisper/decoding.py:132
↓ 1 callers
Class
SuppressBlank
src/models/whisper/whisper/decoding.py:387
↓ 1 callers
Class
SuppressTokens
src/models/whisper/whisper/decoding.py:397
↓ 1 callers
Class
TemporalBasicTransformerBlock
src/models/attention.py:244
↓ 1 callers
Class
TemporalTransformer3DModel
src/models/motion_module.py:94
↓ 1 callers
Class
TemporalTransformerBlock
src/models/motion_module.py:185
↓ 1 callers
Class
TextDecoder
src/models/whisper/whisper/model.py:174
↓ 1 callers
Class
Tokenizer
A thin wrapper around `GPT2TokenizerFast` providing quick access to special tokens
src/models/whisper/whisper/tokenizer.py:130
↓ 1 callers
Class
Transformer2DModelOutput
The output of [`Transformer2DModel`]. Args: sample (`torch.FloatTensor` of shape `(batch_size, num_channels, height, width)` or `(ba
src/models/transformer_2d.py:18
↓ 1 callers
Class
Transformer3DModelOutput
src/models/transformer_3d.py:16
↓ 1 callers
Class
UNet2DConditionOutput
The output of [`UNet2DConditionModel`]. Args: sample (`torch.FloatTensor` of shape `(batch_size, num_channels, height, width)`):
src/models/unet_2d_condition.py:51
↓ 1 callers
Class
UNet3DConditionOutput
src/models/unet_3d.py:26
↓ 1 callers
Class
UNet3DConditionOutput
src/models/unet_3d_echo.py:34
↓ 1 callers
Class
UNetMidBlock2D
A 2D UNet mid-block [`UNetMidBlock2D`] with multiple residual blocks and optional attention blocks. Args: in_channels (`int`): The n
src/models/unet_2d_blocks.py:223
↓ 1 callers
Class
UNetMidBlock2DCrossAttn
src/models/unet_2d_blocks.py:356
↓ 1 callers
Class
UpBlock2D
src/models/unet_2d_blocks.py:962
↓ 1 callers
Class
UpBlock3D
src/models/unet_3d_blocks.py:757
↓ 1 callers
Class
VanillaTemporalModule
src/models/motion_module.py:44
↓ 1 callers
Class
VersatileAttention
src/models/motion_module.py:280
↓ 1 callers
Class
Whisper
src/models/whisper/whisper/model.py:220
Class
AutoencoderTinyBlock
Tiny Autoencoder block used in [`AutoencoderTiny`]. It is a mini residual module consisting of plain conv + ReLU blocks. Args: i
src/models/unet_2d_blocks.py:186
Class
BasicTextNormalizer
src/models/whisper/whisper/normalizers/basic.py:55
Class
Blendshapes
The 52 blendshape coefficients.
src/utils/face_landmark.py:66
Class
EchoUNet3DConditionModel
src/models/unet_3d_echo.py:38
Class
EnglishTextNormalizer
src/models/whisper/whisper/normalizers/english.py:458
Class
FaceLandmarker
Class that performs face landmarks detection on images.
src/utils/face_landmark.py:3070
Class
FaceLandmarksConnections
The connections between face landmarks.
src/utils/face_landmark.py:123
Class
Inference
src/models/whisper/whisper/decoding.py:118
Class
LogitFilter
src/models/whisper/whisper/decoding.py:371
Class
SequenceRanker
src/models/whisper/whisper/decoding.py:164
Class
TemporalTransformer3DModelOutput
src/models/motion_module.py:23
Class
TokenDecoder
src/models/whisper/whisper/decoding.py:199
Class
UNet2DConditionModel
r""" A conditional 2D UNet model that takes a noisy sample, conditional state, and a timestep and returns a sample shaped output. This mo
src/models/unet_2d_condition.py:64
Class
UNet3DConditionModel
src/models/unet_3d.py:30