GLDiTalker: Speech-Driven 3D Facial Animation with Graph Latent Diffusion Transformer
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Lin, Yihong, Fan, Zhaoxin, Wu, Xianjia, Xiong, Lingyu, Peng, Liang, Li, Xiandong, Kang, Wenxiong, Lei, Songju, Xu, Huang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
EmoFace: Emotion-Content Disentangled Speech-Driven 3D Talking Face Animation
von: Lin, Yihong, et al.
Veröffentlicht: (2024)
von: Lin, Yihong, et al.
Veröffentlicht: (2024)
M3DHMR: Monocular 3D Hand Mesh Recovery
von: Lin, Yihong, et al.
Veröffentlicht: (2025)
von: Lin, Yihong, et al.
Veröffentlicht: (2025)
SegTalker: Segmentation-based Talking Face Generation with Mask-guided Local Editing
von: Xiong, Lingyu, et al.
Veröffentlicht: (2024)
von: Xiong, Lingyu, et al.
Veröffentlicht: (2024)
UniTalker: Scaling up Audio-Driven 3D Facial Animation through A Unified Model
von: Fan, Xiangyu, et al.
Veröffentlicht: (2024)
von: Fan, Xiangyu, et al.
Veröffentlicht: (2024)
StreamingTalker: Audio-driven 3D Facial Animation with Autoregressive Diffusion Model
von: Yang, Yifan, et al.
Veröffentlicht: (2025)
von: Yang, Yifan, et al.
Veröffentlicht: (2025)
DiffSpeaker: Speech-Driven 3D Facial Animation with Diffusion Transformer
von: Ma, Zhiyuan, et al.
Veröffentlicht: (2024)
von: Ma, Zhiyuan, et al.
Veröffentlicht: (2024)
MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization
von: Kim, Hyung Kyu, et al.
Veröffentlicht: (2025)
von: Kim, Hyung Kyu, et al.
Veröffentlicht: (2025)
KMTalk: Speech-Driven 3D Facial Animation with Key Motion Embedding
von: Xu, Zhihao, et al.
Veröffentlicht: (2024)
von: Xu, Zhihao, et al.
Veröffentlicht: (2024)
Landmark-guided Diffusion Model for High-fidelity and Temporally Coherent Talking Head Generation
von: Tan, Jintao, et al.
Veröffentlicht: (2024)
von: Tan, Jintao, et al.
Veröffentlicht: (2024)
STMR: Spiral Transformer for Hand Mesh Reconstruction
von: Xie, Huilong, et al.
Veröffentlicht: (2024)
von: Xie, Huilong, et al.
Veröffentlicht: (2024)
PESTalk: Speech-Driven 3D Facial Animation with Personalized Emotional Styles
von: Han, Tianshun, et al.
Veröffentlicht: (2025)
von: Han, Tianshun, et al.
Veröffentlicht: (2025)
AdaMesh: Personalized Facial Expressions and Head Poses for Adaptive Speech-Driven 3D Facial Animation
von: Chen, Liyang, et al.
Veröffentlicht: (2023)
von: Chen, Liyang, et al.
Veröffentlicht: (2023)
AniTalker: Animate Vivid and Diverse Talking Faces through Identity-Decoupled Facial Motion Encoding
von: Liu, Tao, et al.
Veröffentlicht: (2024)
von: Liu, Tao, et al.
Veröffentlicht: (2024)
EmoDiffusion: Enhancing Emotional 3D Facial Animation with Latent Diffusion Models
von: Zhang, Yixuan, et al.
Veröffentlicht: (2025)
von: Zhang, Yixuan, et al.
Veröffentlicht: (2025)
Polyglot: Multilingual Style Preserving Speech-Driven Facial Animation
von: Nocentini, Federico, et al.
Veröffentlicht: (2026)
von: Nocentini, Federico, et al.
Veröffentlicht: (2026)
Diverse Code Query Learning for Speech-Driven Facial Animation
von: Gu, Chunzhi, et al.
Veröffentlicht: (2024)
von: Gu, Chunzhi, et al.
Veröffentlicht: (2024)
AudioFace: Language-Assisted Speech-Driven Facial Animation with Multimodal Language Models
von: Zheng, Kai, et al.
Veröffentlicht: (2026)
von: Zheng, Kai, et al.
Veröffentlicht: (2026)
SAiD: Speech-driven Blendshape Facial Animation with Diffusion
von: Park, Inkyu, et al.
Veröffentlicht: (2023)
von: Park, Inkyu, et al.
Veröffentlicht: (2023)
LSF-Animation: Label-Free Speech-Driven Facial Animation via Implicit Feature Representation
von: Lu, Xin, et al.
Veröffentlicht: (2025)
von: Lu, Xin, et al.
Veröffentlicht: (2025)
DiffusionTalker: Efficient and Compact Speech-Driven 3D Talking Head via Personalizer-Guided Distillation
von: Chen, Peng, et al.
Veröffentlicht: (2025)
von: Chen, Peng, et al.
Veröffentlicht: (2025)
DAE-Talker: High Fidelity Speech-Driven Talking Face Generation with Diffusion Autoencoder
von: Du, Chenpeng, et al.
Veröffentlicht: (2023)
von: Du, Chenpeng, et al.
Veröffentlicht: (2023)
Empowering Whisper as a Joint Multi-Talker and Target-Talker Speech Recognition System
von: Meng, Lingwei, et al.
Veröffentlicht: (2024)
von: Meng, Lingwei, et al.
Veröffentlicht: (2024)
Model See Model Do: Speech-Driven Facial Animation with Style Control
von: Pan, Yifang, et al.
Veröffentlicht: (2025)
von: Pan, Yifang, et al.
Veröffentlicht: (2025)
DiffPoseTalk: Speech-Driven Stylistic 3D Facial Animation and Head Pose Generation via Diffusion Models
von: Sun, Zhiyao, et al.
Veröffentlicht: (2023)
von: Sun, Zhiyao, et al.
Veröffentlicht: (2023)
PC-Talk: Precise Facial Animation Control for Audio-Driven Talking Face Generation
von: Wang, Baiqin, et al.
Veröffentlicht: (2025)
von: Wang, Baiqin, et al.
Veröffentlicht: (2025)
KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation
von: Lyu, Tianle, et al.
Veröffentlicht: (2025)
von: Lyu, Tianle, et al.
Veröffentlicht: (2025)
Wav2Sem: Plug-and-Play Audio Semantic Decoupling for 3D Speech-Driven Facial Animation
von: Li, Hao, et al.
Veröffentlicht: (2025)
von: Li, Hao, et al.
Veröffentlicht: (2025)
DiTalker: A Unified DiT-based Framework for High-Quality and Speaking Styles Controllable Portrait Animation
von: Feng, He, et al.
Veröffentlicht: (2025)
von: Feng, He, et al.
Veröffentlicht: (2025)
KeyframeFace: Language-Driven Facial Animation via Semantic Keyframes
von: Wu, Jingchao, et al.
Veröffentlicht: (2025)
von: Wu, Jingchao, et al.
Veröffentlicht: (2025)
Expressive Speech-driven Facial Animation with controllable emotions
von: Chen, Yutong, et al.
Veröffentlicht: (2023)
von: Chen, Yutong, et al.
Veröffentlicht: (2023)
Thinking in Directivity: Speech Large Language Model for Multi-Talker Directional Speech Recognition
von: Xie, Jiamin, et al.
Veröffentlicht: (2025)
von: Xie, Jiamin, et al.
Veröffentlicht: (2025)
Learning Phonetic Context-Dependent Viseme for Enhancing Speech-Driven 3D Facial Animation
von: Kim, Hyung Kyu, et al.
Veröffentlicht: (2025)
von: Kim, Hyung Kyu, et al.
Veröffentlicht: (2025)
Cross-Speaker Encoding Network for Multi-Talker Speech Recognition
von: Kang, Jiawen, et al.
Veröffentlicht: (2024)
von: Kang, Jiawen, et al.
Veröffentlicht: (2024)
EditEmoTalk: Controllable Speech-Driven 3D Facial Animation with Continuous Expression Editing
von: Jiang, Diqiong, et al.
Veröffentlicht: (2026)
von: Jiang, Diqiong, et al.
Veröffentlicht: (2026)
Content and Style Aware Audio-Driven Facial Animation
von: Liu, Qingju, et al.
Veröffentlicht: (2024)
von: Liu, Qingju, et al.
Veröffentlicht: (2024)
CSTalk: Correlation Supervised Speech-driven 3D Emotional Facial Animation Generation
von: Liang, Xiangyu, et al.
Veröffentlicht: (2024)
von: Liang, Xiangyu, et al.
Veröffentlicht: (2024)
Emotional Speech-driven 3D Body Animation via Disentangled Latent Diffusion
von: Chhatre, Kiran, et al.
Veröffentlicht: (2023)
von: Chhatre, Kiran, et al.
Veröffentlicht: (2023)
ReactDiff: Latent Diffusion for Facial Reaction Generation
von: Li, Jiaming, et al.
Veröffentlicht: (2025)
von: Li, Jiaming, et al.
Veröffentlicht: (2025)
Disentangling Speakers in Multi-Talker Speech Recognition with Speaker-Aware CTC
von: Kang, Jiawen, et al.
Veröffentlicht: (2024)
von: Kang, Jiawen, et al.
Veröffentlicht: (2024)
StyleSpeaker: Audio-Enhanced Fine-Grained Style Modeling for Speech-Driven 3D Facial Animation
von: Yang, An, et al.
Veröffentlicht: (2025)
von: Yang, An, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
EmoFace: Emotion-Content Disentangled Speech-Driven 3D Talking Face Animation
von: Lin, Yihong, et al.
Veröffentlicht: (2024) -
M3DHMR: Monocular 3D Hand Mesh Recovery
von: Lin, Yihong, et al.
Veröffentlicht: (2025) -
SegTalker: Segmentation-based Talking Face Generation with Mask-guided Local Editing
von: Xiong, Lingyu, et al.
Veröffentlicht: (2024) -
UniTalker: Scaling up Audio-Driven 3D Facial Animation through A Unified Model
von: Fan, Xiangyu, et al.
Veröffentlicht: (2024) -
StreamingTalker: Audio-driven 3D Facial Animation with Autoregressive Diffusion Model
von: Yang, Yifan, et al.
Veröffentlicht: (2025)