AniTalker: Animate Vivid and Diverse Talking Faces through Identity-Decoupled Facial Motion Encoding
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Tao, Chen, Feilong, Fan, Shuai, Du, Chenpeng, Chen, Qi, Chen, Xie, Yu, Kai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
VQTalker: Towards Multilingual Talking Avatars through Facial Motion Tokenization
por: Liu, Tao, et al.
Publicado: (2024)
por: Liu, Tao, et al.
Publicado: (2024)
DAE-Talker: High Fidelity Speech-Driven Talking Face Generation with Diffusion Autoencoder
por: Du, Chenpeng, et al.
Publicado: (2023)
por: Du, Chenpeng, et al.
Publicado: (2023)
DiffDub: Person-generic Visual Dubbing Using Inpainting Renderer with Diffusion Auto-encoder
por: Liu, Tao, et al.
Publicado: (2023)
por: Liu, Tao, et al.
Publicado: (2023)
GSTalker: Real-time Audio-Driven Talking Face Generation via Deformable Gaussian Splatting
por: Chen, Bo, et al.
Publicado: (2024)
por: Chen, Bo, et al.
Publicado: (2024)
IMTalker: Efficient Audio-driven Talking Face Generation with Implicit Motion Transfer
por: Chen, Bo, et al.
Publicado: (2025)
por: Chen, Bo, et al.
Publicado: (2025)
FaceEditTalker: Controllable Talking Head Generation with Facial Attribute Editing
por: Feng, Guanwen, et al.
Publicado: (2025)
por: Feng, Guanwen, et al.
Publicado: (2025)
PC-Talk: Precise Facial Animation Control for Audio-Driven Talking Face Generation
por: Wang, Baiqin, et al.
Publicado: (2025)
por: Wang, Baiqin, et al.
Publicado: (2025)
StreamingTalker: Audio-driven 3D Facial Animation with Autoregressive Diffusion Model
por: Yang, Yifan, et al.
Publicado: (2025)
por: Yang, Yifan, et al.
Publicado: (2025)
Phone-Level Prosody Modelling with GMM-Based MDN for Diverse and Controllable Speech Synthesis
por: Du, Chenpeng, et al.
Publicado: (2021)
por: Du, Chenpeng, et al.
Publicado: (2021)
LSCodec: Low-Bitrate and Speaker-Decoupled Discrete Speech Codec
por: Guo, Yiwei, et al.
Publicado: (2024)
por: Guo, Yiwei, et al.
Publicado: (2024)
M2DAO-Talker: Harmonizing Multi-granular Motion Decoupling and Alternating Optimization for Talking-head Generation
por: Jiang, Kui, et al.
Publicado: (2025)
por: Jiang, Kui, et al.
Publicado: (2025)
Make-It-Vivid: Dressing Your Animatable Biped Cartoon Characters from Text
por: Tang, Junshu, et al.
Publicado: (2024)
por: Tang, Junshu, et al.
Publicado: (2024)
UniTalker: Scaling up Audio-Driven 3D Facial Animation through A Unified Model
por: Fan, Xiangyu, et al.
Publicado: (2024)
por: Fan, Xiangyu, et al.
Publicado: (2024)
AniGaussian: Animatable Gaussian Avatar with Pose-guided Deformation
por: Li, Mengtian, et al.
Publicado: (2025)
por: Li, Mengtian, et al.
Publicado: (2025)
AnyI2V: Animating Any Conditional Image with Motion Control
por: Li, Ziye, et al.
Publicado: (2025)
por: Li, Ziye, et al.
Publicado: (2025)
VQTTS: High-Fidelity Text-to-Speech Synthesis with Self-Supervised VQ Acoustic Feature
por: Du, Chenpeng, et al.
Publicado: (2022)
por: Du, Chenpeng, et al.
Publicado: (2022)
Cafe-Talk: Generating 3D Talking Face Animation with Multimodal Coarse- and Fine-grained Control
por: Chen, Hejia, et al.
Publicado: (2025)
por: Chen, Hejia, et al.
Publicado: (2025)
AnyTalker: Scaling Multi-Person Talking Video Generation with Interactivity Refinement
por: Zhong, Zhizhou, et al.
Publicado: (2025)
por: Zhong, Zhizhou, et al.
Publicado: (2025)
GLDiTalker: Speech-Driven 3D Facial Animation with Graph Latent Diffusion Transformer
por: Lin, Yihong, et al.
Publicado: (2024)
por: Lin, Yihong, et al.
Publicado: (2024)
EmoTalker: Emotionally Editable Talking Face Generation via Diffusion Model
por: Zhang, Bingyuan, et al.
Publicado: (2024)
por: Zhang, Bingyuan, et al.
Publicado: (2024)
Learning Semantic Facial Descriptors for Accurate Face Animation
por: Zhu, Lei, et al.
Publicado: (2025)
por: Zhu, Lei, et al.
Publicado: (2025)
HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis
por: Liu, Shiyu, et al.
Publicado: (2025)
por: Liu, Shiyu, et al.
Publicado: (2025)
Attention-Constrained Inference for Robust Decoder-Only Text-to-Speech
por: Wang, Hankun, et al.
Publicado: (2024)
por: Wang, Hankun, et al.
Publicado: (2024)
EditEmoTalk: Controllable Speech-Driven 3D Facial Animation with Continuous Expression Editing
por: Jiang, Diqiong, et al.
Publicado: (2026)
por: Jiang, Diqiong, et al.
Publicado: (2026)
VividFace: Real-Time and Realistic Facial Expression Shadowing for Humanoid Robots
por: Li, Peizhen, et al.
Publicado: (2026)
por: Li, Peizhen, et al.
Publicado: (2026)
AniGaussian: Animatable Gaussian Avatar With Pose‐Guided Deformation
por: M. Li, et al.
Publicado: (2026)
por: M. Li, et al.
Publicado: (2026)
MVPortrait: Text-Guided Motion and Emotion Control for Multi-view Vivid Portrait Animation
por: Lin, Yukang, et al.
Publicado: (2025)
por: Lin, Yukang, et al.
Publicado: (2025)
Chain-of-Talkers (CoTalk): Fast Human Annotation of Dense Image Captions
por: Shen, Yijun, et al.
Publicado: (2025)
por: Shen, Yijun, et al.
Publicado: (2025)
Acoustic BPE for Speech Generation with Discrete Tokens
por: Shen, Feiyu, et al.
Publicado: (2023)
por: Shen, Feiyu, et al.
Publicado: (2023)
VoiceFlow: Efficient Text-to-Speech with Rectified Flow Matching
por: Guo, Yiwei, et al.
Publicado: (2023)
por: Guo, Yiwei, et al.
Publicado: (2023)
VividFace: High-Quality and Efficient One-Step Diffusion For Video Face Enhancement
por: Zhang, Shulian, et al.
Publicado: (2025)
por: Zhang, Shulian, et al.
Publicado: (2025)
MAGIC-Talk: Motion-aware Audio-Driven Talking Face Generation with Customizable Identity Control
por: Nazarieh, Fatemeh, et al.
Publicado: (2025)
por: Nazarieh, Fatemeh, et al.
Publicado: (2025)
SegTalker: Segmentation-based Talking Face Generation with Mask-guided Local Editing
por: Xiong, Lingyu, et al.
Publicado: (2024)
por: Xiong, Lingyu, et al.
Publicado: (2024)
D^3-Talker: Dual-Branch Decoupled Deformation Fields for Few-Shot 3D Talking Head Synthesis
por: Guo, Yuhang, et al.
Publicado: (2025)
por: Guo, Yuhang, et al.
Publicado: (2025)
MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization
por: Kim, Hyung Kyu, et al.
Publicado: (2025)
por: Kim, Hyung Kyu, et al.
Publicado: (2025)
MIMAFace: Face Animation via Motion-Identity Modulated Appearance Feature Learning
por: Han, Yue, et al.
Publicado: (2024)
por: Han, Yue, et al.
Publicado: (2024)
GaussianTalker: Speaker-specific Talking Head Synthesis via 3D Gaussian Splatting
por: Yu, Hongyun, et al.
Publicado: (2024)
por: Yu, Hongyun, et al.
Publicado: (2024)
MegActor: Harness the Power of Raw Video for Vivid Portrait Animation
por: Yang, Shurong, et al.
Publicado: (2024)
por: Yang, Shurong, et al.
Publicado: (2024)
FacEDiT: Unified Talking Face Editing and Generation via Facial Motion Infilling
por: Sung-Bin, Kim, et al.
Publicado: (2025)
por: Sung-Bin, Kim, et al.
Publicado: (2025)
Learning Disentangled Speech- and Expression-Driven Blendshapes for 3D Talking Face Animation
por: Mao, Yuxiang, et al.
Publicado: (2025)
por: Mao, Yuxiang, et al.
Publicado: (2025)
Ejemplares similares
-
VQTalker: Towards Multilingual Talking Avatars through Facial Motion Tokenization
por: Liu, Tao, et al.
Publicado: (2024) -
DAE-Talker: High Fidelity Speech-Driven Talking Face Generation with Diffusion Autoencoder
por: Du, Chenpeng, et al.
Publicado: (2023) -
DiffDub: Person-generic Visual Dubbing Using Inpainting Renderer with Diffusion Auto-encoder
por: Liu, Tao, et al.
Publicado: (2023) -
GSTalker: Real-time Audio-Driven Talking Face Generation via Deformable Gaussian Splatting
por: Chen, Bo, et al.
Publicado: (2024) -
IMTalker: Efficient Audio-driven Talking Face Generation with Implicit Motion Transfer
por: Chen, Bo, et al.
Publicado: (2025)