Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/antgroup/echomimic_v2
/ types & classes
Types & classes
84 in github.com/antgroup/echomimic_v2
⨍
Functions
395
◇
Types & classes
84
↓ 17 callers
Class
InflatedConv3d
src/models/resnet.py:9
↓ 6 callers
Class
Linear
src/models/whisper/whisper/model.py:34
↓ 6 callers
Class
ResnetBlock3D
src/models/resnet.py:123
↓ 5 callers
Class
LayerNorm
src/models/whisper/whisper/model.py:29
↓ 4 callers
Class
InflatedGroupNorm
src/models/resnet.py:20
↓ 4 callers
Class
PoseEncoder
src/models/pose_encoder.py:12
↓ 4 callers
Class
ReferenceAttentionControl
src/models/mutual_self_attention.py:19
↓ 3 callers
Class
Transformer2DModel
A 2D Transformer model for image-like data. Parameters: num_attention_heads (`int`, *optional*, defaults to 16): The number of h
src/models/transformer_2d.py:33
↓ 3 callers
Class
Transformer3DModel
src/models/transformer_3d.py:27
↓ 2 callers
Class
Audio2Feature
src/models/whisper/audio2feature.py:8
↓ 2 callers
Class
Conv1d
src/models/whisper/whisper/model.py:41
↓ 2 callers
Class
DecodingResult
src/models/whisper/whisper/decoding.py:104
↓ 2 callers
Class
Downsample3D
src/models/resnet.py:93
↓ 2 callers
Class
EchoMimicV2Pipeline
src/pipelines/pipeline_echomimicv2.py:34
↓ 2 callers
Class
EchoMimicV2Pipeline
src/pipelines/pipeline_echomimicv2_acc.py:34
↓ 2 callers
Class
MultiHeadAttention
src/models/whisper/whisper/model.py:57
↓ 2 callers
Class
PositionalEncoding
src/models/motion_module.py:263
↓ 2 callers
Class
ResidualAttentionBlock
src/models/whisper/whisper/model.py:103
↓ 2 callers
Class
UNetMidBlock3DCrossAttn
src/models/unet_3d_blocks.py:171
↓ 2 callers
Class
Upsample3D
src/models/resnet.py:31
↓ 1 callers
Class
ApplyTimestampRules
src/models/whisper/whisper/decoding.py:405
↓ 1 callers
Class
AudioEncoder
src/models/whisper/whisper/model.py:131
↓ 1 callers
Class
BasicTransformerBlock
r""" A basic Transformer block. Parameters: dim (`int`): The number of channels in the input and output. num_attention_heads
src/models/attention.py:12
↓ 1 callers
Class
BeamSearchDecoder
src/models/whisper/whisper/decoding.py:281
↓ 1 callers
Class
CrossAttnDownBlock2D
src/models/unet_2d_blocks.py:511
↓ 1 callers
Class
CrossAttnDownBlock3D
src/models/unet_3d_blocks.py:298
↓ 1 callers
Class
CrossAttnUpBlock2D
src/models/unet_2d_blocks.py:780
↓ 1 callers
Class
CrossAttnUpBlock3D
src/models/unet_3d_blocks.py:591
↓ 1 callers
Class
DWposeDetector
A pose detect method for image-like data. Parameters: model_det: (str) serialized ONNX format model path, such
src/models/dwpose/dwpose_detector.py:11
↓ 1 callers
Class
DecodingOptions
src/models/whisper/whisper/decoding.py:72
↓ 1 callers
Class
DecodingTask
src/models/whisper/whisper/decoding.py:444
↓ 1 callers
Class
DotDict
src/utils/util_emo.py:159
↓ 1 callers
Class
DownBlock2D
src/models/unet_2d_blocks.py:682
↓ 1 callers
Class
DownBlock3D
src/models/unet_3d_blocks.py:472
↓ 1 callers
Class
EchoMimicV2PipelineOutput
src/pipelines/pipeline_echomimicv2.py:30
↓ 1 callers
Class
EchoMimicV2PipelineOutput
src/pipelines/pipeline_echomimicv2_acc.py:30
↓ 1 callers
Class
EnglishNumberNormalizer
Convert any spelled-out numbers into arabic numbers, while handling: - remove any commas - keep the suffixes such as: `1960s`, `274th`,
src/models/whisper/whisper/normalizers/english.py:12
↓ 1 callers
Class
EnglishSpellingNormalizer
Applies British-American spelling mappings as listed in [1]. [1] https://www.tysto.com/uk-us-spelling-list.html
src/models/whisper/whisper/normalizers/english.py:443
↓ 1 callers
Class
GreedyDecoder
src/models/whisper/whisper/decoding.py:253
↓ 1 callers
Class
MaximumLikelihoodRanker
Select the sample with the highest log probabilities, penalized using either a simple length normalization or Google NMT paper's length penal
src/models/whisper/whisper/decoding.py:173
↓ 1 callers
Class
Mish
src/models/resnet.py:250
↓ 1 callers
Class
ModelDimensions
src/models/whisper/whisper/model.py:16
↓ 1 callers
Class
MyDDIM
src/pipelines/myschedulers.py:26
↓ 1 callers
Class
PyTorchInference
src/models/whisper/whisper/decoding.py:132
↓ 1 callers
Class
SuppressBlank
src/models/whisper/whisper/decoding.py:387
↓ 1 callers
Class
SuppressTokens
src/models/whisper/whisper/decoding.py:397
↓ 1 callers
Class
TemporalBasicTransformerBlock
src/models/attention.py:244
↓ 1 callers
Class
TemporalTransformer3DModel
src/models/motion_module.py:94
↓ 1 callers
Class
TemporalTransformerBlock
src/models/motion_module.py:186
↓ 1 callers
Class
TextDecoder
src/models/whisper/whisper/model.py:174
↓ 1 callers
Class
Tokenizer
A thin wrapper around `GPT2TokenizerFast` providing quick access to special tokens
src/models/whisper/whisper/tokenizer.py:130
↓ 1 callers
Class
Transformer2DModelOutput
The output of [`Transformer2DModel`]. Args: sample (`torch.FloatTensor` of shape `(batch_size, num_channels, height, width)` or
src/models/transformer_2d.py:19
↓ 1 callers
Class
Transformer3DModelOutput
src/models/transformer_3d.py:16
↓ 1 callers
Class
UNet2DConditionOutput
The output of [`UNet2DConditionModel`]. Args: sample (`torch.FloatTensor` of shape `(batch_size, num_channels, height, width)`):
src/models/unet_2d_condition.py:52
↓ 1 callers
Class
UNet3DConditionOutput
src/models/unet_3d.py:26
↓ 1 callers
Class
UNet3DConditionOutput
src/models/unet_3d_emo.py:26
↓ 1 callers
Class
UNetMidBlock2D
A 2D UNet mid-block [`UNetMidBlock2D`] with multiple residual blocks and optional attention blocks. Args: in_channels (`int`): T
src/models/unet_2d_blocks.py:224
↓ 1 callers
Class
UNetMidBlock2DCrossAttn
src/models/unet_2d_blocks.py:357
↓ 1 callers
Class
UpBlock2D
src/models/unet_2d_blocks.py:963
↓ 1 callers
Class
UpBlock3D
src/models/unet_3d_blocks.py:757
↓ 1 callers
Class
VanillaTemporalModule
src/models/motion_module.py:44
↓ 1 callers
Class
VersatileAttention
src/models/motion_module.py:281
↓ 1 callers
Class
Wav2Vec
src/models/wav_clip.py:17
↓ 1 callers
Class
Whisper
src/models/whisper/whisper/model.py:220
↓ 1 callers
Class
Wholebody
detect human pose by dwpose
src/models/dwpose/wholebody.py:8
Class
AudioCrossAttention
src/models/motion_module.py:392
Class
AudioFeatureMapper
src/models/wav_clip.py:34
Class
AutoFlow
src/utils/util_emo.py:24
Class
AutoencoderTinyBlock
Tiny Autoencoder block used in [`AutoencoderTiny`]. It is a mini residual module consisting of plain conv + ReLU blocks. Args:
src/models/unet_2d_blocks.py:187
Class
BasicTextNormalizer
src/models/whisper/whisper/normalizers/basic.py:55
Class
EMOUNet3DConditionModel
src/models/unet_3d_emo.py:30
Class
EnglishTextNormalizer
src/models/whisper/whisper/normalizers/english.py:458
Class
FaceMeshVisualizer
src/utils/draw_utils.py:6
Class
Inference
src/models/whisper/whisper/decoding.py:118
Class
LogitFilter
src/models/whisper/whisper/decoding.py:371
Class
MyEulerA
src/pipelines/myschedulers.py:134
Class
MySchedulers
src/pipelines/myschedulers.py:8
Class
MyWav2Vec
src/utils/util_emo.py:10
Class
PoseGuider
src/models/pose_guider.py:12
Class
SequenceRanker
src/models/whisper/whisper/decoding.py:164
Class
TemporalTransformer3DModelOutput
src/models/motion_module.py:23
Class
TokenDecoder
src/models/whisper/whisper/decoding.py:199
Class
UNet2DConditionModel
r""" A conditional 2D UNet model that takes a noisy sample, conditional state, and a timestep and returns a sample shaped output. Thi
src/models/unet_2d_condition.py:65
Class
UNet3DConditionModel
src/models/unet_3d.py:30