Cafe-Talk: Generating 3D Talking Face Animation with Multimodal Coarse- and Fine-grained Control
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Hejia, Zhang, Haoxian, Zhang, Shoulong, Liu, Xiaoqiang, Zhuang, Sisi, Zhang, Yuan, Wan, Pengfei, Zhang, Di, Li, Shuai |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GGTalker: Talking Head Systhesis with Generalizable Gaussian Priors and Identity-Specific Adaptation
di: Hu, Wentao, et al.
Pubblicazione: (2025)
di: Hu, Wentao, et al.
Pubblicazione: (2025)
PC-Talk: Precise Facial Animation Control for Audio-Driven Talking Face Generation
di: Wang, Baiqin, et al.
Pubblicazione: (2025)
di: Wang, Baiqin, et al.
Pubblicazione: (2025)
Learning Disentangled Speech- and Expression-Driven Blendshapes for 3D Talking Face Animation
di: Mao, Yuxiang, et al.
Pubblicazione: (2025)
di: Mao, Yuxiang, et al.
Pubblicazione: (2025)
LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control
di: Guo, Jianzhu, et al.
Pubblicazione: (2024)
di: Guo, Jianzhu, et al.
Pubblicazione: (2024)
Learn2Talk: 3D Talking Face Learns from 2D Talking Face
di: Zhuang, Yixiang, et al.
Pubblicazione: (2024)
di: Zhuang, Yixiang, et al.
Pubblicazione: (2024)
Taming Transformer for Emotion-Controllable Talking Face Generation
di: Zhang, Ziqi, et al.
Pubblicazione: (2025)
di: Zhang, Ziqi, et al.
Pubblicazione: (2025)
EmoSpeaker: One-shot Fine-grained Emotion-Controlled Talking Face Generation
di: Feng, Guanwen, et al.
Pubblicazione: (2024)
di: Feng, Guanwen, et al.
Pubblicazione: (2024)
G4G:A Generic Framework for High Fidelity Talking Face Generation with Fine-grained Intra-modal Alignment
di: Zhang, Juan, et al.
Pubblicazione: (2024)
di: Zhang, Juan, et al.
Pubblicazione: (2024)
OT-Talk: Animating 3D Talking Head with Optimal Transportation
di: Wang, Xinmu, et al.
Pubblicazione: (2025)
di: Wang, Xinmu, et al.
Pubblicazione: (2025)
Versatile Multimodal Controls for Expressive Talking Human Animation
di: Qin, Zheng, et al.
Pubblicazione: (2025)
di: Qin, Zheng, et al.
Pubblicazione: (2025)
EmoFace: Emotion-Content Disentangled Speech-Driven 3D Talking Face Animation
di: Lin, Yihong, et al.
Pubblicazione: (2024)
di: Lin, Yihong, et al.
Pubblicazione: (2024)
3D-Aware Implicit Motion Control for View-Adaptive Human Video Generation
di: Fang, Zhixue, et al.
Pubblicazione: (2026)
di: Fang, Zhixue, et al.
Pubblicazione: (2026)
IM-Animation: An Implicit Motion Representation for Identity-decoupled Character Animation
di: Xu, Zhufeng, et al.
Pubblicazione: (2026)
di: Xu, Zhufeng, et al.
Pubblicazione: (2026)
MIDAS: Multimodal Interactive Digital-humAn Synthesis via Real-time Autoregressive Video Generation
di: Chen, Ming, et al.
Pubblicazione: (2025)
di: Chen, Ming, et al.
Pubblicazione: (2025)
TalkingEyes: Pluralistic Speech-Driven 3D Eye Gaze Animation
di: Zhuang, Yixiang, et al.
Pubblicazione: (2025)
di: Zhuang, Yixiang, et al.
Pubblicazione: (2025)
AVI-Talking: Learning Audio-Visual Instructions for Expressive 3D Talking Face Generation
di: Sun, Yasheng, et al.
Pubblicazione: (2024)
di: Sun, Yasheng, et al.
Pubblicazione: (2024)
Toward Fine-Grained Facial Control in 3D Talking Head Generation
di: Xie, Shaoyang, et al.
Pubblicazione: (2026)
di: Xie, Shaoyang, et al.
Pubblicazione: (2026)
Text-Driven Emotionally Continuous Talking Face Generation
di: Yang, Hao, et al.
Pubblicazione: (2026)
di: Yang, Hao, et al.
Pubblicazione: (2026)
IP-Adapter Is All You Need: Towards Fine-Tuning-Free Diffusion-Based Talking Face Generation
di: Wu, Hao, et al.
Pubblicazione: (2026)
di: Wu, Hao, et al.
Pubblicazione: (2026)
From Inpainting to Editing: Unlocking Robust Mask-Free Visual Dubbing via Generative Bootstrapping
di: He, Xu, et al.
Pubblicazione: (2025)
di: He, Xu, et al.
Pubblicazione: (2025)
PTalker: Personalized Speech-Driven 3D Talking Head Animation via Style Disentanglement and Modality Alignment
di: Wang, Bin, et al.
Pubblicazione: (2025)
di: Wang, Bin, et al.
Pubblicazione: (2025)
SwapTalk: Audio-Driven Talking Face Generation with One-Shot Customization in Latent Space
di: Zhang, Zeren, et al.
Pubblicazione: (2024)
di: Zhang, Zeren, et al.
Pubblicazione: (2024)
MAGIC-Talk: Motion-aware Audio-Driven Talking Face Generation with Customizable Identity Control
di: Nazarieh, Fatemeh, et al.
Pubblicazione: (2025)
di: Nazarieh, Fatemeh, et al.
Pubblicazione: (2025)
Audio-Driven Talking Face Generation with Blink Embedding and Hash Grid Landmarks Encoding
di: Zhang, Yuhui, et al.
Pubblicazione: (2026)
di: Zhang, Yuhui, et al.
Pubblicazione: (2026)
TalkingPose: Efficient Face and Gesture Animation with Feedback-guided Diffusion Model
di: Javanmardi, Alireza, et al.
Pubblicazione: (2025)
di: Javanmardi, Alireza, et al.
Pubblicazione: (2025)
AniTalker: Animate Vivid and Diverse Talking Faces through Identity-Decoupled Facial Motion Encoding
di: Liu, Tao, et al.
Pubblicazione: (2024)
di: Liu, Tao, et al.
Pubblicazione: (2024)
EMOdiffhead: Continuously Emotional Control in Talking Head Generation via Diffusion
di: Zhang, Jian, et al.
Pubblicazione: (2024)
di: Zhang, Jian, et al.
Pubblicazione: (2024)
CapTalk: Text-Guided Stylization and Speech-Driven 3D Head Animation
di: Chu, Xuangeng, et al.
Pubblicazione: (2026)
di: Chu, Xuangeng, et al.
Pubblicazione: (2026)
EmoTalker: Emotionally Editable Talking Face Generation via Diffusion Model
di: Zhang, Bingyuan, et al.
Pubblicazione: (2024)
di: Zhang, Bingyuan, et al.
Pubblicazione: (2024)
DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
Controllable Talking Face Generation by Implicit Facial Keypoints Editing
di: Zhao, Dong, et al.
Pubblicazione: (2024)
di: Zhao, Dong, et al.
Pubblicazione: (2024)
Joint Co-Speech Gesture and Expressive Talking Face Generation using Diffusion with Adapters
di: Hogue, Steven, et al.
Pubblicazione: (2024)
di: Hogue, Steven, et al.
Pubblicazione: (2024)
Context-aware Talking Face Video Generation
di: Xuanyuan, Meidai, et al.
Pubblicazione: (2024)
di: Xuanyuan, Meidai, et al.
Pubblicazione: (2024)
PortraitTalk: Towards Customizable One-Shot Audio-to-Talking Face Generation
di: Nazarieh, Fatemeh, et al.
Pubblicazione: (2024)
di: Nazarieh, Fatemeh, et al.
Pubblicazione: (2024)
Monocular and Generalizable Gaussian Talking Head Animation
di: Gong, Shengjie, et al.
Pubblicazione: (2025)
di: Gong, Shengjie, et al.
Pubblicazione: (2025)
GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
di: Agarwal, Madhav, et al.
Pubblicazione: (2025)
di: Agarwal, Madhav, et al.
Pubblicazione: (2025)
TurboTalk: Progressive Distillation for One-Step Audio-Driven Talking Avatar Generation
di: Liu, Xiangyu, et al.
Pubblicazione: (2026)
di: Liu, Xiangyu, et al.
Pubblicazione: (2026)
TalkingGaussian: Structure-Persistent 3D Talking Head Synthesis via Gaussian Splatting
di: Li, Jiahe, et al.
Pubblicazione: (2024)
di: Li, Jiahe, et al.
Pubblicazione: (2024)
Perception-as-Control: Fine-grained Controllable Image Animation with 3D-aware Motion Representation
di: Chen, Yingjie, et al.
Pubblicazione: (2025)
di: Chen, Yingjie, et al.
Pubblicazione: (2025)
EditEmoTalk: Controllable Speech-Driven 3D Facial Animation with Continuous Expression Editing
di: Jiang, Diqiong, et al.
Pubblicazione: (2026)
di: Jiang, Diqiong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
GGTalker: Talking Head Systhesis with Generalizable Gaussian Priors and Identity-Specific Adaptation
di: Hu, Wentao, et al.
Pubblicazione: (2025) -
PC-Talk: Precise Facial Animation Control for Audio-Driven Talking Face Generation
di: Wang, Baiqin, et al.
Pubblicazione: (2025) -
Learning Disentangled Speech- and Expression-Driven Blendshapes for 3D Talking Face Animation
di: Mao, Yuxiang, et al.
Pubblicazione: (2025) -
LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control
di: Guo, Jianzhu, et al.
Pubblicazione: (2024) -
Learn2Talk: 3D Talking Face Learns from 2D Talking Face
di: Zhuang, Yixiang, et al.
Pubblicazione: (2024)