DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Ma, Yifeng, Zhang, Shiwei, Wang, Jiayu, Wang, Xiang, Zhang, Yingya, Deng, Zhidong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles
por: Ma, Yifeng, et al.
Publicado: (2023)
por: Ma, Yifeng, et al.
Publicado: (2023)
StyleTalk++: A Unified Framework for Controlling the Speaking Styles of Talking Heads
por: Wang, Suzhen, et al.
Publicado: (2024)
por: Wang, Suzhen, et al.
Publicado: (2024)
S^3D-NeRF: Single-Shot Speech-Driven Neural Radiance Field for High Fidelity Talking Head Synthesis
por: Li, Dongze, et al.
Publicado: (2024)
por: Li, Dongze, et al.
Publicado: (2024)
EMOdiffhead: Continuously Emotional Control in Talking Head Generation via Diffusion
por: Zhang, Jian, et al.
Publicado: (2024)
por: Zhang, Jian, et al.
Publicado: (2024)
EmotiveTalk: Expressive Talking Head Generation through Audio Information Decoupling and Emotional Video Diffusion
por: Wang, Haotian, et al.
Publicado: (2024)
por: Wang, Haotian, et al.
Publicado: (2024)
EmoDiffTalk:Emotion-aware Diffusion for Editable 3D Gaussian Talking Head
por: Liu, Chang, et al.
Publicado: (2025)
por: Liu, Chang, et al.
Publicado: (2025)
MoCoTalk: Multi-Conditional Diffusion with Adaptive Router for Controllable Talking Head Generation
por: Ye, Xinyan, et al.
Publicado: (2026)
por: Ye, Xinyan, et al.
Publicado: (2026)
Taming Transformer for Emotion-Controllable Talking Face Generation
por: Zhang, Ziqi, et al.
Publicado: (2025)
por: Zhang, Ziqi, et al.
Publicado: (2025)
EmoTalkingGaussian: Continuous Emotion-conditioned Talking Head Synthesis
por: Cha, Junuk, et al.
Publicado: (2025)
por: Cha, Junuk, et al.
Publicado: (2025)
FreeTalk: Emotional Topology-Free 3D Talking Heads
por: Nocentini, Federico, et al.
Publicado: (2026)
por: Nocentini, Federico, et al.
Publicado: (2026)
ConsistTalk: Intensity Controllable Temporally Consistent Talking Head Generation with Diffusion Noise Search
por: Liu, Zhenjie, et al.
Publicado: (2025)
por: Liu, Zhenjie, et al.
Publicado: (2025)
UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation
por: Wang, Xiang, et al.
Publicado: (2024)
por: Wang, Xiang, et al.
Publicado: (2024)
FD2Talk: Towards Generalized Talking Head Generation with Facial Decoupled Diffusion Model
por: Yao, Ziyu, et al.
Publicado: (2024)
por: Yao, Ziyu, et al.
Publicado: (2024)
EmoTalk3D: High-Fidelity Free-View Synthesis of Emotional 3D Talking Head
por: He, Qianyun, et al.
Publicado: (2024)
por: He, Qianyun, et al.
Publicado: (2024)
OT-Talk: Animating 3D Talking Head with Optimal Transportation
por: Wang, Xinmu, et al.
Publicado: (2025)
por: Wang, Xinmu, et al.
Publicado: (2025)
SyncTalk: The Devil is in the Synchronization for Talking Head Synthesis
por: Peng, Ziqiao, et al.
Publicado: (2023)
por: Peng, Ziqiao, et al.
Publicado: (2023)
Jump Cut Smoothing for Talking Heads
por: Wang, Xiaojuan, et al.
Publicado: (2024)
por: Wang, Xiaojuan, et al.
Publicado: (2024)
AUHead: Realistic Emotional Talking Head Generation via Action Units Control
por: Lyu, Jiayi, et al.
Publicado: (2026)
por: Lyu, Jiayi, et al.
Publicado: (2026)
Dimitra: Audio-driven Diffusion model for Expressive Talking Head Generation
por: Chopin, Baptiste, et al.
Publicado: (2025)
por: Chopin, Baptiste, et al.
Publicado: (2025)
EDTalk: Efficient Disentanglement for Emotional Talking Head Synthesis
por: Tan, Shuai, et al.
Publicado: (2024)
por: Tan, Shuai, et al.
Publicado: (2024)
EmoTalker: Emotionally Editable Talking Face Generation via Diffusion Model
por: Zhang, Bingyuan, et al.
Publicado: (2024)
por: Zhang, Bingyuan, et al.
Publicado: (2024)
MoDA: Multi-modal Diffusion Architecture for Talking Head Generation
por: Li, Xinyang, et al.
Publicado: (2025)
por: Li, Xinyang, et al.
Publicado: (2025)
SVP: Style-Enhanced Vivid Portrait Talking Head Diffusion Model
por: Tan, Weipeng, et al.
Publicado: (2024)
por: Tan, Weipeng, et al.
Publicado: (2024)
GMTalker: Gaussian Mixture-based Audio-Driven Emotional Talking Video Portraits
por: Xia, Yibo, et al.
Publicado: (2023)
por: Xia, Yibo, et al.
Publicado: (2023)
GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
por: Agarwal, Madhav, et al.
Publicado: (2025)
por: Agarwal, Madhav, et al.
Publicado: (2025)
THEval. Evaluation Framework for Talking Head Video Generation
por: Quignon, Nabyl, et al.
Publicado: (2025)
por: Quignon, Nabyl, et al.
Publicado: (2025)
LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space
por: Feng, Guanwen, et al.
Publicado: (2024)
por: Feng, Guanwen, et al.
Publicado: (2024)
EmoHead: Emotional Talking Head via Manipulating Semantic Expression Parameters
por: Shen, Xuli, et al.
Publicado: (2025)
por: Shen, Xuli, et al.
Publicado: (2025)
SwapTalk: Audio-Driven Talking Face Generation with One-Shot Customization in Latent Space
por: Zhang, Zeren, et al.
Publicado: (2024)
por: Zhang, Zeren, et al.
Publicado: (2024)
SyncTalk++: High-Fidelity and Efficient Synchronized Talking Heads Synthesis Using Gaussian Splatting
por: Peng, Ziqiao, et al.
Publicado: (2025)
por: Peng, Ziqiao, et al.
Publicado: (2025)
EmoVOCA: Speech-Driven Emotional 3D Talking Heads
por: Nocentini, Federico, et al.
Publicado: (2024)
por: Nocentini, Federico, et al.
Publicado: (2024)
DreamRelation: Relation-Centric Video Customization
por: Wei, Yujie, et al.
Publicado: (2025)
por: Wei, Yujie, et al.
Publicado: (2025)
ScanTalk: 3D Talking Heads from Unregistered Scans
por: Nocentini, Federico, et al.
Publicado: (2024)
por: Nocentini, Federico, et al.
Publicado: (2024)
JambaTalk: Speech-Driven 3D Talking Head Generation Based on Hybrid Transformer-Mamba Model
por: Jafari, Farzaneh, et al.
Publicado: (2024)
por: Jafari, Farzaneh, et al.
Publicado: (2024)
FixTalk: Taming Identity Leakage for High-Quality Talking Head Generation in Extreme Cases
por: Tan, Shuai, et al.
Publicado: (2025)
por: Tan, Shuai, et al.
Publicado: (2025)
FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis
por: Wang, Mengchao, et al.
Publicado: (2025)
por: Wang, Mengchao, et al.
Publicado: (2025)
TalkVid: A Large-Scale Diversified Dataset for Audio-Driven Talking Head Synthesis
por: Chen, Shunian, et al.
Publicado: (2025)
por: Chen, Shunian, et al.
Publicado: (2025)
TalkingGaussian: Structure-Persistent 3D Talking Head Synthesis via Gaussian Splatting
por: Li, Jiahe, et al.
Publicado: (2024)
por: Li, Jiahe, et al.
Publicado: (2024)
RealTalk: Realistic Emotion-Aware Lifelike Talking-Head Synthesis
por: Wang, Wenqing, et al.
Publicado: (2025)
por: Wang, Wenqing, et al.
Publicado: (2025)
Text-Driven Emotionally Continuous Talking Face Generation
por: Yang, Hao, et al.
Publicado: (2026)
por: Yang, Hao, et al.
Publicado: (2026)
Ejemplares similares
-
TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles
por: Ma, Yifeng, et al.
Publicado: (2023) -
StyleTalk++: A Unified Framework for Controlling the Speaking Styles of Talking Heads
por: Wang, Suzhen, et al.
Publicado: (2024) -
S^3D-NeRF: Single-Shot Speech-Driven Neural Radiance Field for High Fidelity Talking Head Synthesis
por: Li, Dongze, et al.
Publicado: (2024) -
EMOdiffhead: Continuously Emotional Control in Talking Head Generation via Diffusion
por: Zhang, Jian, et al.
Publicado: (2024) -
EmotiveTalk: Expressive Talking Head Generation through Audio Information Decoupling and Emotional Video Diffusion
por: Wang, Haotian, et al.
Publicado: (2024)