Landmark-guided Diffusion Model for High-fidelity and Temporally Coherent Talking Head Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tan, Jintao, Cheng, Xize, Xiong, Lingyu, Zhu, Lei, Li, Xiandong, Wu, Xianjia, Gong, Kai, Li, Minglei, Cai, Yi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SegTalker: Segmentation-based Talking Face Generation with Mask-guided Local Editing
par: Xiong, Lingyu, et autres
Publié: (2024)
par: Xiong, Lingyu, et autres
Publié: (2024)
High-fidelity and Lip-synced Talking Face Synthesis via Landmark-based Diffusion Model
par: Zhong, Weizhi, et autres
Publié: (2024)
par: Zhong, Weizhi, et autres
Publié: (2024)
GLDiTalker: Speech-Driven 3D Facial Animation with Graph Latent Diffusion Transformer
par: Lin, Yihong, et autres
Publié: (2024)
par: Lin, Yihong, et autres
Publié: (2024)
EmoFace: Emotion-Content Disentangled Speech-Driven 3D Talking Face Animation
par: Lin, Yihong, et autres
Publié: (2024)
par: Lin, Yihong, et autres
Publié: (2024)
EAD-Net: Emotion-Aware Talking Head Generation with Spatial Refinement and Temporal Coherence
par: Li, Yahui, et autres
Publié: (2026)
par: Li, Yahui, et autres
Publié: (2026)
FixTalk: Taming Identity Leakage for High-Quality Talking Head Generation in Extreme Cases
par: Tan, Shuai, et autres
Publié: (2025)
par: Tan, Shuai, et autres
Publié: (2025)
Talking Head Generation via AU-Guided Landmark Prediction
par: Chang, Shao-Yu, et autres
Publié: (2025)
par: Chang, Shao-Yu, et autres
Publié: (2025)
ATL-Diff: Audio-Driven Talking Head Generation with Early Landmarks-Guide Noise Diffusion
par: Vo, Hoang-Son, et autres
Publié: (2025)
par: Vo, Hoang-Son, et autres
Publié: (2025)
Towards High-fidelity 3D Talking Avatar with Personalized Dynamic Texture
par: Li, Xuanchen, et autres
Publié: (2025)
par: Li, Xuanchen, et autres
Publié: (2025)
GaussianHead: High-fidelity Head Avatars with Learnable Gaussian Derivation
par: Wang, Jie, et autres
Publié: (2023)
par: Wang, Jie, et autres
Publié: (2023)
M3DHMR: Monocular 3D Hand Mesh Recovery
par: Lin, Yihong, et autres
Publié: (2025)
par: Lin, Yihong, et autres
Publié: (2025)
Multi-fidelity Parameter Estimation Using Conditional Diffusion Models
par: Tatsuoka, Caroline, et autres
Publié: (2025)
par: Tatsuoka, Caroline, et autres
Publié: (2025)
DreamHead: Learning Spatial-Temporal Correspondence via Hierarchical Diffusion for Audio-driven Talking Head Synthesis
par: Hong, Fa-Ting, et autres
Publié: (2024)
par: Hong, Fa-Ting, et autres
Publié: (2024)
ConsistTalk: Intensity Controllable Temporally Consistent Talking Head Generation with Diffusion Noise Search
par: Liu, Zhenjie, et autres
Publié: (2025)
par: Liu, Zhenjie, et autres
Publié: (2025)
MoDA: Multi-modal Diffusion Architecture for Talking Head Generation
par: Li, Xinyang, et autres
Publié: (2025)
par: Li, Xinyang, et autres
Publié: (2025)
SVP: Style-Enhanced Vivid Portrait Talking Head Diffusion Model
par: Tan, Weipeng, et autres
Publié: (2024)
par: Tan, Weipeng, et autres
Publié: (2024)
DiffusionAvatars: Deferred Diffusion for High-fidelity 3D Head Avatars
par: Kirschstein, Tobias, et autres
Publié: (2023)
par: Kirschstein, Tobias, et autres
Publié: (2023)
FD2Talk: Towards Generalized Talking Head Generation with Facial Decoupled Diffusion Model
par: Yao, Ziyu, et autres
Publié: (2024)
par: Yao, Ziyu, et autres
Publié: (2024)
SoulX-FlashHead: Oracle-guided Generation of Infinite Real-time Streaming Talking Heads
par: Yu, Tan, et autres
Publié: (2026)
par: Yu, Tan, et autres
Publié: (2026)
SPEAK: Speech-Driven Pose and Emotion-Adjustable Talking Head Generation
par: Cai, Changpeng, et autres
Publié: (2024)
par: Cai, Changpeng, et autres
Publié: (2024)
ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance
par: Yang, Haijie, et autres
Publié: (2024)
par: Yang, Haijie, et autres
Publié: (2024)
EmoTalk3D: High-Fidelity Free-View Synthesis of Emotional 3D Talking Head
par: He, Qianyun, et autres
Publié: (2024)
par: He, Qianyun, et autres
Publié: (2024)
Monocular and Generalizable Gaussian Talking Head Animation
par: Gong, Shengjie, et autres
Publié: (2025)
par: Gong, Shengjie, et autres
Publié: (2025)
FREAK: Frequency-modulated High-fidelity and Real-time Audio-driven Talking Portrait Synthesis
par: Ni, Ziqi, et autres
Publié: (2025)
par: Ni, Ziqi, et autres
Publié: (2025)
HPGN: Hybrid Priors-Guided Network for Compressed Low-Light Image Enhancement
par: Li, Hantang, et autres
Publié: (2025)
par: Li, Hantang, et autres
Publié: (2025)
Ditto: Motion-Space Diffusion for Controllable Realtime Talking Head Synthesis
par: Li, Tianqi, et autres
Publié: (2024)
par: Li, Tianqi, et autres
Publié: (2024)
MMTalker: Multiresolution 3D Talking Head Synthesis with Multimodal Feature Fusion
par: Liu, Bin, et autres
Publié: (2026)
par: Liu, Bin, et autres
Publié: (2026)
Learning Dynamic Tetrahedra for High-Quality Talking Head Synthesis
par: Zhang, Zicheng, et autres
Publié: (2024)
par: Zhang, Zicheng, et autres
Publié: (2024)
Enhance Multi-Scale Spatial-Temporal Coherence for Configurable Video Anomaly Detection
par: Cheng, Kai, et autres
Publié: (2023)
par: Cheng, Kai, et autres
Publié: (2023)
RTHDet: Rotate Table Area and Head Detection in images
par: Hu, Wenxing, et autres
Publié: (2023)
par: Hu, Wenxing, et autres
Publié: (2023)
IM-Portrait: Learning 3D-aware Video Diffusion for Photorealistic Talking Heads from Monocular Videos
par: Li, Yuan, et autres
Publié: (2025)
par: Li, Yuan, et autres
Publié: (2025)
EDTalk++: Full Disentanglement for Controllable Talking Head Synthesis
par: Tan, Shuai, et autres
Publié: (2025)
par: Tan, Shuai, et autres
Publié: (2025)
TalkingHeadBench: A Multi-Modal Benchmark & Analysis of Talking-Head DeepFake Detection
par: Xiong, Xinqi, et autres
Publié: (2025)
par: Xiong, Xinqi, et autres
Publié: (2025)
SyncDiff: Diffusion-based Talking Head Synthesis with Bottlenecked Temporal Visual Prior for Improved Synchronization
par: Fan, Xulin, et autres
Publié: (2025)
par: Fan, Xulin, et autres
Publié: (2025)
EmotiveTalk: Expressive Talking Head Generation through Audio Information Decoupling and Emotional Video Diffusion
par: Wang, Haotian, et autres
Publié: (2024)
par: Wang, Haotian, et autres
Publié: (2024)
SyncTalk: The Devil is in the Synchronization for Talking Head Synthesis
par: Peng, Ziqiao, et autres
Publié: (2023)
par: Peng, Ziqiao, et autres
Publié: (2023)
SyncTalk++: High-Fidelity and Efficient Synchronized Talking Heads Synthesis Using Gaussian Splatting
par: Peng, Ziqiao, et autres
Publié: (2025)
par: Peng, Ziqiao, et autres
Publié: (2025)
DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
par: Ma, Yifeng, et autres
Publié: (2023)
par: Ma, Yifeng, et autres
Publié: (2023)
Style2Talker: High-Resolution Talking Head Generation with Emotion Style and Art Style
par: Tan, Shuai, et autres
Publié: (2024)
par: Tan, Shuai, et autres
Publié: (2024)
TempoSyncDiff: Distilled Temporally-Consistent Diffusion for Low-Latency Audio-Driven Talking Head Generation
par: Mazumdar, Soumya, et autres
Publié: (2026)
par: Mazumdar, Soumya, et autres
Publié: (2026)
Documents similaires
-
SegTalker: Segmentation-based Talking Face Generation with Mask-guided Local Editing
par: Xiong, Lingyu, et autres
Publié: (2024) -
High-fidelity and Lip-synced Talking Face Synthesis via Landmark-based Diffusion Model
par: Zhong, Weizhi, et autres
Publié: (2024) -
GLDiTalker: Speech-Driven 3D Facial Animation with Graph Latent Diffusion Transformer
par: Lin, Yihong, et autres
Publié: (2024) -
EmoFace: Emotion-Content Disentangled Speech-Driven 3D Talking Face Animation
par: Lin, Yihong, et autres
Publié: (2024) -
EAD-Net: Emotion-Aware Talking Head Generation with Spatial Refinement and Temporal Coherence
par: Li, Yahui, et autres
Publié: (2026)