Cafe-Talk: Generating 3D Talking Face Animation with Multimodal Coarse- and Fine-grained Control
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Hejia, Zhang, Haoxian, Zhang, Shoulong, Liu, Xiaoqiang, Zhuang, Sisi, Zhang, Yuan, Wan, Pengfei, Zhang, Di, Li, Shuai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GGTalker: Talking Head Systhesis with Generalizable Gaussian Priors and Identity-Specific Adaptation
por: Hu, Wentao, et al.
Publicado: (2025)
por: Hu, Wentao, et al.
Publicado: (2025)
PC-Talk: Precise Facial Animation Control for Audio-Driven Talking Face Generation
por: Wang, Baiqin, et al.
Publicado: (2025)
por: Wang, Baiqin, et al.
Publicado: (2025)
Learning Disentangled Speech- and Expression-Driven Blendshapes for 3D Talking Face Animation
por: Mao, Yuxiang, et al.
Publicado: (2025)
por: Mao, Yuxiang, et al.
Publicado: (2025)
LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control
por: Guo, Jianzhu, et al.
Publicado: (2024)
por: Guo, Jianzhu, et al.
Publicado: (2024)
Learn2Talk: 3D Talking Face Learns from 2D Talking Face
por: Zhuang, Yixiang, et al.
Publicado: (2024)
por: Zhuang, Yixiang, et al.
Publicado: (2024)
Taming Transformer for Emotion-Controllable Talking Face Generation
por: Zhang, Ziqi, et al.
Publicado: (2025)
por: Zhang, Ziqi, et al.
Publicado: (2025)
EmoSpeaker: One-shot Fine-grained Emotion-Controlled Talking Face Generation
por: Feng, Guanwen, et al.
Publicado: (2024)
por: Feng, Guanwen, et al.
Publicado: (2024)
G4G:A Generic Framework for High Fidelity Talking Face Generation with Fine-grained Intra-modal Alignment
por: Zhang, Juan, et al.
Publicado: (2024)
por: Zhang, Juan, et al.
Publicado: (2024)
OT-Talk: Animating 3D Talking Head with Optimal Transportation
por: Wang, Xinmu, et al.
Publicado: (2025)
por: Wang, Xinmu, et al.
Publicado: (2025)
Versatile Multimodal Controls for Expressive Talking Human Animation
por: Qin, Zheng, et al.
Publicado: (2025)
por: Qin, Zheng, et al.
Publicado: (2025)
EmoFace: Emotion-Content Disentangled Speech-Driven 3D Talking Face Animation
por: Lin, Yihong, et al.
Publicado: (2024)
por: Lin, Yihong, et al.
Publicado: (2024)
3D-Aware Implicit Motion Control for View-Adaptive Human Video Generation
por: Fang, Zhixue, et al.
Publicado: (2026)
por: Fang, Zhixue, et al.
Publicado: (2026)
IM-Animation: An Implicit Motion Representation for Identity-decoupled Character Animation
por: Xu, Zhufeng, et al.
Publicado: (2026)
por: Xu, Zhufeng, et al.
Publicado: (2026)
MIDAS: Multimodal Interactive Digital-humAn Synthesis via Real-time Autoregressive Video Generation
por: Chen, Ming, et al.
Publicado: (2025)
por: Chen, Ming, et al.
Publicado: (2025)
TalkingEyes: Pluralistic Speech-Driven 3D Eye Gaze Animation
por: Zhuang, Yixiang, et al.
Publicado: (2025)
por: Zhuang, Yixiang, et al.
Publicado: (2025)
AVI-Talking: Learning Audio-Visual Instructions for Expressive 3D Talking Face Generation
por: Sun, Yasheng, et al.
Publicado: (2024)
por: Sun, Yasheng, et al.
Publicado: (2024)
Toward Fine-Grained Facial Control in 3D Talking Head Generation
por: Xie, Shaoyang, et al.
Publicado: (2026)
por: Xie, Shaoyang, et al.
Publicado: (2026)
Text-Driven Emotionally Continuous Talking Face Generation
por: Yang, Hao, et al.
Publicado: (2026)
por: Yang, Hao, et al.
Publicado: (2026)
IP-Adapter Is All You Need: Towards Fine-Tuning-Free Diffusion-Based Talking Face Generation
por: Wu, Hao, et al.
Publicado: (2026)
por: Wu, Hao, et al.
Publicado: (2026)
From Inpainting to Editing: Unlocking Robust Mask-Free Visual Dubbing via Generative Bootstrapping
por: He, Xu, et al.
Publicado: (2025)
por: He, Xu, et al.
Publicado: (2025)
PTalker: Personalized Speech-Driven 3D Talking Head Animation via Style Disentanglement and Modality Alignment
por: Wang, Bin, et al.
Publicado: (2025)
por: Wang, Bin, et al.
Publicado: (2025)
SwapTalk: Audio-Driven Talking Face Generation with One-Shot Customization in Latent Space
por: Zhang, Zeren, et al.
Publicado: (2024)
por: Zhang, Zeren, et al.
Publicado: (2024)
MAGIC-Talk: Motion-aware Audio-Driven Talking Face Generation with Customizable Identity Control
por: Nazarieh, Fatemeh, et al.
Publicado: (2025)
por: Nazarieh, Fatemeh, et al.
Publicado: (2025)
Audio-Driven Talking Face Generation with Blink Embedding and Hash Grid Landmarks Encoding
por: Zhang, Yuhui, et al.
Publicado: (2026)
por: Zhang, Yuhui, et al.
Publicado: (2026)
TalkingPose: Efficient Face and Gesture Animation with Feedback-guided Diffusion Model
por: Javanmardi, Alireza, et al.
Publicado: (2025)
por: Javanmardi, Alireza, et al.
Publicado: (2025)
AniTalker: Animate Vivid and Diverse Talking Faces through Identity-Decoupled Facial Motion Encoding
por: Liu, Tao, et al.
Publicado: (2024)
por: Liu, Tao, et al.
Publicado: (2024)
EMOdiffhead: Continuously Emotional Control in Talking Head Generation via Diffusion
por: Zhang, Jian, et al.
Publicado: (2024)
por: Zhang, Jian, et al.
Publicado: (2024)
CapTalk: Text-Guided Stylization and Speech-Driven 3D Head Animation
por: Chu, Xuangeng, et al.
Publicado: (2026)
por: Chu, Xuangeng, et al.
Publicado: (2026)
EmoTalker: Emotionally Editable Talking Face Generation via Diffusion Model
por: Zhang, Bingyuan, et al.
Publicado: (2024)
por: Zhang, Bingyuan, et al.
Publicado: (2024)
DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
por: Ma, Yifeng, et al.
Publicado: (2023)
por: Ma, Yifeng, et al.
Publicado: (2023)
Controllable Talking Face Generation by Implicit Facial Keypoints Editing
por: Zhao, Dong, et al.
Publicado: (2024)
por: Zhao, Dong, et al.
Publicado: (2024)
Joint Co-Speech Gesture and Expressive Talking Face Generation using Diffusion with Adapters
por: Hogue, Steven, et al.
Publicado: (2024)
por: Hogue, Steven, et al.
Publicado: (2024)
Context-aware Talking Face Video Generation
por: Xuanyuan, Meidai, et al.
Publicado: (2024)
por: Xuanyuan, Meidai, et al.
Publicado: (2024)
PortraitTalk: Towards Customizable One-Shot Audio-to-Talking Face Generation
por: Nazarieh, Fatemeh, et al.
Publicado: (2024)
por: Nazarieh, Fatemeh, et al.
Publicado: (2024)
Monocular and Generalizable Gaussian Talking Head Animation
por: Gong, Shengjie, et al.
Publicado: (2025)
por: Gong, Shengjie, et al.
Publicado: (2025)
GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
por: Agarwal, Madhav, et al.
Publicado: (2025)
por: Agarwal, Madhav, et al.
Publicado: (2025)
TurboTalk: Progressive Distillation for One-Step Audio-Driven Talking Avatar Generation
por: Liu, Xiangyu, et al.
Publicado: (2026)
por: Liu, Xiangyu, et al.
Publicado: (2026)
TalkingGaussian: Structure-Persistent 3D Talking Head Synthesis via Gaussian Splatting
por: Li, Jiahe, et al.
Publicado: (2024)
por: Li, Jiahe, et al.
Publicado: (2024)
Perception-as-Control: Fine-grained Controllable Image Animation with 3D-aware Motion Representation
por: Chen, Yingjie, et al.
Publicado: (2025)
por: Chen, Yingjie, et al.
Publicado: (2025)
EditEmoTalk: Controllable Speech-Driven 3D Facial Animation with Continuous Expression Editing
por: Jiang, Diqiong, et al.
Publicado: (2026)
por: Jiang, Diqiong, et al.
Publicado: (2026)
Ejemplares similares
-
GGTalker: Talking Head Systhesis with Generalizable Gaussian Priors and Identity-Specific Adaptation
por: Hu, Wentao, et al.
Publicado: (2025) -
PC-Talk: Precise Facial Animation Control for Audio-Driven Talking Face Generation
por: Wang, Baiqin, et al.
Publicado: (2025) -
Learning Disentangled Speech- and Expression-Driven Blendshapes for 3D Talking Face Animation
por: Mao, Yuxiang, et al.
Publicado: (2025) -
LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control
por: Guo, Jianzhu, et al.
Publicado: (2024) -
Learn2Talk: 3D Talking Face Learns from 2D Talking Face
por: Zhuang, Yixiang, et al.
Publicado: (2024)