AudioFace: Language-Assisted Speech-Driven Facial Animation with Multimodal Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zheng, Kai, Kang, Zejian, Mao, Rui, Zou, Hongyuan, Fei, Yuanchen, Xu, Xuanyang, Huang, Xiangru |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
KeyframeFace: Language-Driven Facial Animation via Semantic Keyframes
di: Wu, Jingchao, et al.
Pubblicazione: (2025)
di: Wu, Jingchao, et al.
Pubblicazione: (2025)
SuperFace: Preference-Aligned Facial Expression Estimation Beyond Pseudo Supervision
di: Kang, Zejian, et al.
Pubblicazione: (2026)
di: Kang, Zejian, et al.
Pubblicazione: (2026)
SemanticFace: Semantic Facial Action Estimation via Semantic Distillation in Interpretable Space
di: Kang, Zejian, et al.
Pubblicazione: (2026)
di: Kang, Zejian, et al.
Pubblicazione: (2026)
Exploring the Role of Synthetic Data Augmentation in Controllable Human-Centric Video Generation
di: Fei, Yuanchen, et al.
Pubblicazione: (2026)
di: Fei, Yuanchen, et al.
Pubblicazione: (2026)
PC-Talk: Precise Facial Animation Control for Audio-Driven Talking Face Generation
di: Wang, Baiqin, et al.
Pubblicazione: (2025)
di: Wang, Baiqin, et al.
Pubblicazione: (2025)
LinguaLinker: Audio-Driven Portraits Animation with Implicit Facial Control Enhancement
di: Zhang, Rui, et al.
Pubblicazione: (2024)
di: Zhang, Rui, et al.
Pubblicazione: (2024)
KMTalk: Speech-Driven 3D Facial Animation with Key Motion Embedding
di: Xu, Zhihao, et al.
Pubblicazione: (2024)
di: Xu, Zhihao, et al.
Pubblicazione: (2024)
ESGaussianFace: Emotional and Stylized Audio-Driven Facial Animation via 3D Gaussian Splatting
di: Ma, Chuhang, et al.
Pubblicazione: (2026)
di: Ma, Chuhang, et al.
Pubblicazione: (2026)
GLDiTalker: Speech-Driven 3D Facial Animation with Graph Latent Diffusion Transformer
di: Lin, Yihong, et al.
Pubblicazione: (2024)
di: Lin, Yihong, et al.
Pubblicazione: (2024)
KeyFace: Expressive Audio-Driven Facial Animation for Long Sequences via KeyFrame Interpolation
di: Bigata, Antoni, et al.
Pubblicazione: (2025)
di: Bigata, Antoni, et al.
Pubblicazione: (2025)
AdaMesh: Personalized Facial Expressions and Head Poses for Adaptive Speech-Driven 3D Facial Animation
di: Chen, Liyang, et al.
Pubblicazione: (2023)
di: Chen, Liyang, et al.
Pubblicazione: (2023)
MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization
di: Kim, Hyung Kyu, et al.
Pubblicazione: (2025)
di: Kim, Hyung Kyu, et al.
Pubblicazione: (2025)
Polyglot: Multilingual Style Preserving Speech-Driven Facial Animation
di: Nocentini, Federico, et al.
Pubblicazione: (2026)
di: Nocentini, Federico, et al.
Pubblicazione: (2026)
Diverse Code Query Learning for Speech-Driven Facial Animation
di: Gu, Chunzhi, et al.
Pubblicazione: (2024)
di: Gu, Chunzhi, et al.
Pubblicazione: (2024)
EmoFace: Emotion-Content Disentangled Speech-Driven 3D Talking Face Animation
di: Lin, Yihong, et al.
Pubblicazione: (2024)
di: Lin, Yihong, et al.
Pubblicazione: (2024)
Audio Driven Real-Time Facial Animation for Social Telepresence
di: Lee, Jiye, et al.
Pubblicazione: (2025)
di: Lee, Jiye, et al.
Pubblicazione: (2025)
Enhancing Speech-Driven 3D Facial Animation with Audio-Visual Guidance from Lip Reading Expert
di: EunGi, Han, et al.
Pubblicazione: (2024)
di: EunGi, Han, et al.
Pubblicazione: (2024)
SparseOIT: Improving Order-Independent Transparency 3DGS via Active Set Method
di: Yang, Wentao, et al.
Pubblicazione: (2026)
di: Yang, Wentao, et al.
Pubblicazione: (2026)
LSF-Animation: Label-Free Speech-Driven Facial Animation via Implicit Feature Representation
di: Lu, Xin, et al.
Pubblicazione: (2025)
di: Lu, Xin, et al.
Pubblicazione: (2025)
Learning Disentangled Speech- and Expression-Driven Blendshapes for 3D Talking Face Animation
di: Mao, Yuxiang, et al.
Pubblicazione: (2025)
di: Mao, Yuxiang, et al.
Pubblicazione: (2025)
Wav2Sem: Plug-and-Play Audio Semantic Decoupling for 3D Speech-Driven Facial Animation
di: Li, Hao, et al.
Pubblicazione: (2025)
di: Li, Hao, et al.
Pubblicazione: (2025)
EditEmoTalk: Controllable Speech-Driven 3D Facial Animation with Continuous Expression Editing
di: Jiang, Diqiong, et al.
Pubblicazione: (2026)
di: Jiang, Diqiong, et al.
Pubblicazione: (2026)
Learning Semantic Facial Descriptors for Accurate Face Animation
di: Zhu, Lei, et al.
Pubblicazione: (2025)
di: Zhu, Lei, et al.
Pubblicazione: (2025)
JoyVASA: Portrait and Animal Image Animation with Diffusion-Based Audio-Driven Facial Dynamics and Head Motion Generation
di: Cao, Xuyang, et al.
Pubblicazione: (2024)
di: Cao, Xuyang, et al.
Pubblicazione: (2024)
DiffSpeaker: Speech-Driven 3D Facial Animation with Diffusion Transformer
di: Ma, Zhiyuan, et al.
Pubblicazione: (2024)
di: Ma, Zhiyuan, et al.
Pubblicazione: (2024)
Expressive Speech-driven Facial Animation with controllable emotions
di: Chen, Yutong, et al.
Pubblicazione: (2023)
di: Chen, Yutong, et al.
Pubblicazione: (2023)
EmoFace: Audio-driven Emotional 3D Face Animation
di: Liu, Chang, et al.
Pubblicazione: (2024)
di: Liu, Chang, et al.
Pubblicazione: (2024)
TDMM-LM: Bridging Facial Understanding and Animation via Language Models
di: Song, Luchuan, et al.
Pubblicazione: (2026)
di: Song, Luchuan, et al.
Pubblicazione: (2026)
DEEPTalk: Dynamic Emotion Embedding for Probabilistic Speech-Driven 3D Face Animation
di: Kim, Jisoo, et al.
Pubblicazione: (2024)
di: Kim, Jisoo, et al.
Pubblicazione: (2024)
Talking Head Generation Driven by Speech-Related Facial Action Units and Audio- Based on Multimodal Representation Fusion
di: Chen, Sen, et al.
Pubblicazione: (2022)
di: Chen, Sen, et al.
Pubblicazione: (2022)
Learning Phonetic Context-Dependent Viseme for Enhancing Speech-Driven 3D Facial Animation
di: Kim, Hyung Kyu, et al.
Pubblicazione: (2025)
di: Kim, Hyung Kyu, et al.
Pubblicazione: (2025)
UniTalker: Scaling up Audio-Driven 3D Facial Animation through A Unified Model
di: Fan, Xiangyu, et al.
Pubblicazione: (2024)
di: Fan, Xiangyu, et al.
Pubblicazione: (2024)
FaceCraft4D: Animated 3D Facial Avatar Generation from a Single Image
di: Yin, Fei, et al.
Pubblicazione: (2025)
di: Yin, Fei, et al.
Pubblicazione: (2025)
MoEE: Mixture of Emotion Experts for Audio-Driven Portrait Animation
di: Liu, Huaize, et al.
Pubblicazione: (2025)
di: Liu, Huaize, et al.
Pubblicazione: (2025)
PGAHum: Prior-Guided Geometry and Appearance Learning for High-Fidelity Animatable Human Reconstruction
di: Wang, Hao, et al.
Pubblicazione: (2024)
di: Wang, Hao, et al.
Pubblicazione: (2024)
Media2Face: Co-speech Facial Animation Generation With Multi-Modality Guidance
di: Zhao, Qingcheng, et al.
Pubblicazione: (2024)
di: Zhao, Qingcheng, et al.
Pubblicazione: (2024)
AniTalker: Animate Vivid and Diverse Talking Faces through Identity-Decoupled Facial Motion Encoding
di: Liu, Tao, et al.
Pubblicazione: (2024)
di: Liu, Tao, et al.
Pubblicazione: (2024)
3DFacePolicy: Audio-Driven 3D Facial Animation Based on Action Control
di: Sha, Xuanmeng, et al.
Pubblicazione: (2024)
di: Sha, Xuanmeng, et al.
Pubblicazione: (2024)
Audio-Driven Talking Face Video Generation with Joint Uncertainty Learning
di: Xie, Yifan, et al.
Pubblicazione: (2025)
di: Xie, Yifan, et al.
Pubblicazione: (2025)
Animation Needs Attention: A Holistic Approach to Slides Animation Comprehension with Visual-Language Models
di: Jiang, Yifan, et al.
Pubblicazione: (2025)
di: Jiang, Yifan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
KeyframeFace: Language-Driven Facial Animation via Semantic Keyframes
di: Wu, Jingchao, et al.
Pubblicazione: (2025) -
SuperFace: Preference-Aligned Facial Expression Estimation Beyond Pseudo Supervision
di: Kang, Zejian, et al.
Pubblicazione: (2026) -
SemanticFace: Semantic Facial Action Estimation via Semantic Distillation in Interpretable Space
di: Kang, Zejian, et al.
Pubblicazione: (2026) -
Exploring the Role of Synthetic Data Augmentation in Controllable Human-Centric Video Generation
di: Fei, Yuanchen, et al.
Pubblicazione: (2026) -
PC-Talk: Precise Facial Animation Control for Audio-Driven Talking Face Generation
di: Wang, Baiqin, et al.
Pubblicazione: (2025)