MANGO:Natural Multi-speaker 3D Talking Head Generation via 2D-Lifted Enhancement
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhu, Lei, Lin, Lijian, Zhu, Ye, Wu, Jiahao, Hou, Xuehan, Li, Yu, Liu, Yunfei, Chen, Jie |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PEAR: Pixel-aligned Expressive humAn mesh Recovery
par: Wu, Jiahao, et autres
Publié: (2026)
par: Wu, Jiahao, et autres
Publié: (2026)
MelTok: 2D Tokenization for Single-Codebook Audio Compression
par: Li, Jingyi, et autres
Publié: (2025)
par: Li, Jingyi, et autres
Publié: (2025)
Qffusion: Controllable Portrait Video Editing via Quadrant-Grid Attention Learning
par: Li, Maomao, et autres
Publié: (2025)
par: Li, Maomao, et autres
Publié: (2025)
TEASER: Token Enhanced Spatial Modeling for Expressions Reconstruction
par: Liu, Yunfei, et autres
Publié: (2025)
par: Liu, Yunfei, et autres
Publié: (2025)
GUAVA: Generalizable Upper Body 3D Gaussian Avatar
par: Zhang, Dongbin, et autres
Publié: (2025)
par: Zhang, Dongbin, et autres
Publié: (2025)
EmoTalk3D: High-Fidelity Free-View Synthesis of Emotional 3D Talking Head
par: He, Qianyun, et autres
Publié: (2024)
par: He, Qianyun, et autres
Publié: (2024)
HRAvatar: High-Quality and Relightable Gaussian Head Avatar
par: Zhang, Dongbin, et autres
Publié: (2025)
par: Zhang, Dongbin, et autres
Publié: (2025)
OT-Talk: Animating 3D Talking Head with Optimal Transportation
par: Wang, Xinmu, et autres
Publié: (2025)
par: Wang, Xinmu, et autres
Publié: (2025)
LEMAS: Large A 150K-Hour Large-scale Extensible Multilingual Audio Suite with Generative Speech Models
par: Zhao, Zhiyuan, et autres
Publié: (2026)
par: Zhao, Zhiyuan, et autres
Publié: (2026)
Toward Fine-Grained Facial Control in 3D Talking Head Generation
par: Xie, Shaoyang, et autres
Publié: (2026)
par: Xie, Shaoyang, et autres
Publié: (2026)
DiffPoseTalk: Speech-Driven Stylistic 3D Facial Animation and Head Pose Generation via Diffusion Models
par: Sun, Zhiyao, et autres
Publié: (2023)
par: Sun, Zhiyao, et autres
Publié: (2023)
PGSTalker: Real-Time Audio-Driven Talking Head Generation via 3D Gaussian Splatting with Pixel-Aware Density Control
par: Zhu, Tianheng, et autres
Publié: (2025)
par: Zhu, Tianheng, et autres
Publié: (2025)
MultiTalk: Enhancing 3D Talking Head Generation Across Languages with Multilingual Video Dataset
par: Sung-Bin, Kim, et autres
Publié: (2024)
par: Sung-Bin, Kim, et autres
Publié: (2024)
TalkingGaussian: Structure-Persistent 3D Talking Head Synthesis via Gaussian Splatting
par: Li, Jiahe, et autres
Publié: (2024)
par: Li, Jiahe, et autres
Publié: (2024)
DualTalk: Dual-Speaker Interaction for 3D Talking Head Conversations
par: Peng, Ziqiao, et autres
Publié: (2025)
par: Peng, Ziqiao, et autres
Publié: (2025)
GaussianTalker: Speaker-specific Talking Head Synthesis via 3D Gaussian Splatting
par: Yu, Hongyun, et autres
Publié: (2024)
par: Yu, Hongyun, et autres
Publié: (2024)
MsFEM-Inspired CNNs with Transfer Learning for Multiscale Model Reduction
par: Zhang, Xuehan, et autres
Publié: (2026)
par: Zhang, Xuehan, et autres
Publié: (2026)
DreamHead: Learning Spatial-Temporal Correspondence via Hierarchical Diffusion for Audio-driven Talking Head Synthesis
par: Hong, Fa-Ting, et autres
Publié: (2024)
par: Hong, Fa-Ting, et autres
Publié: (2024)
FreeTalk: Emotional Topology-Free 3D Talking Heads
par: Nocentini, Federico, et autres
Publié: (2026)
par: Nocentini, Federico, et autres
Publié: (2026)
ScanTalk: 3D Talking Heads from Unregistered Scans
par: Nocentini, Federico, et autres
Publié: (2024)
par: Nocentini, Federico, et autres
Publié: (2024)
MoCoTalk: Multi-Conditional Diffusion with Adaptive Router for Controllable Talking Head Generation
par: Ye, Xinyan, et autres
Publié: (2026)
par: Ye, Xinyan, et autres
Publié: (2026)
GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
par: Agarwal, Madhav, et autres
Publié: (2025)
par: Agarwal, Madhav, et autres
Publié: (2025)
GPAvatar: Generalizable and Precise Head Avatar from Image(s)
par: Chu, Xuangeng, et autres
Publié: (2024)
par: Chu, Xuangeng, et autres
Publié: (2024)
EmoGene: Audio-Driven Emotional 3D Talking-Head Generation
par: Wang, Wenqing, et autres
Publié: (2024)
par: Wang, Wenqing, et autres
Publié: (2024)
Few-Shot Identity Adaptation for 3D Talking Heads via Global Gaussian Field
par: Nie, Hong, et autres
Publié: (2025)
par: Nie, Hong, et autres
Publié: (2025)
Generative Enhancement for 3D Medical Images
par: Zhu, Lingting, et autres
Publié: (2024)
par: Zhu, Lingting, et autres
Publié: (2024)
JambaTalk: Speech-Driven 3D Talking Head Generation Based on Hybrid Transformer-Mamba Model
par: Jafari, Farzaneh, et autres
Publié: (2024)
par: Jafari, Farzaneh, et autres
Publié: (2024)
Towards Native Generative Model for 3D Head Avatar
par: Zhuang, Yiyu, et autres
Publié: (2024)
par: Zhuang, Yiyu, et autres
Publié: (2024)
Lifting Motion to the 3D World via 2D Diffusion
par: Li, Jiaman, et autres
Publié: (2024)
par: Li, Jiaman, et autres
Publié: (2024)
NLDF: Neural Light Dynamic Fields for Efficient 3D Talking Head Generation
par: Guanchen, Niu
Publié: (2024)
par: Guanchen, Niu
Publié: (2024)
CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation
par: Luo, Xiangyang, et autres
Publié: (2025)
par: Luo, Xiangyang, et autres
Publié: (2025)
PointTalk: Audio-Driven Dynamic Lip Point Cloud for 3D Gaussian-based Talking Head Synthesis
par: Xie, Yifan, et autres
Publié: (2024)
par: Xie, Yifan, et autres
Publié: (2024)
Landmark-guided Diffusion Model for High-fidelity and Temporally Coherent Talking Head Generation
par: Tan, Jintao, et autres
Publié: (2024)
par: Tan, Jintao, et autres
Publié: (2024)
EmoDiffTalk:Emotion-aware Diffusion for Editable 3D Gaussian Talking Head
par: Liu, Chang, et autres
Publié: (2025)
par: Liu, Chang, et autres
Publié: (2025)
AsymTalker: Identity-Consistent Long-Term Talking Head Generation via Asymmetric Distillation
par: Lu, Yuxin, et autres
Publié: (2026)
par: Lu, Yuxin, et autres
Publié: (2026)
Talk3D: High-Fidelity Talking Portrait Synthesis via Personalized 3D Generative Prior
par: Ko, Jaehoon, et autres
Publié: (2024)
par: Ko, Jaehoon, et autres
Publié: (2024)
MuPPet: Multi-person 2D-to-3D Pose Lifting
par: Markhorst, Thomas, et autres
Publié: (2026)
par: Markhorst, Thomas, et autres
Publié: (2026)
Talking Head Generation via AU-Guided Landmark Prediction
par: Chang, Shao-Yu, et autres
Publié: (2025)
par: Chang, Shao-Yu, et autres
Publié: (2025)
EGSTalker: Real-Time Audio-Driven Talking Head Generation with Efficient Gaussian Deformation
par: Zhu, Tianheng, et autres
Publié: (2025)
par: Zhu, Tianheng, et autres
Publié: (2025)
SPEAK: Speech-Driven Pose and Emotion-Adjustable Talking Head Generation
par: Cai, Changpeng, et autres
Publié: (2024)
par: Cai, Changpeng, et autres
Publié: (2024)
Documents similaires
-
PEAR: Pixel-aligned Expressive humAn mesh Recovery
par: Wu, Jiahao, et autres
Publié: (2026) -
MelTok: 2D Tokenization for Single-Codebook Audio Compression
par: Li, Jingyi, et autres
Publié: (2025) -
Qffusion: Controllable Portrait Video Editing via Quadrant-Grid Attention Learning
par: Li, Maomao, et autres
Publié: (2025) -
TEASER: Token Enhanced Spatial Modeling for Expressions Reconstruction
par: Liu, Yunfei, et autres
Publié: (2025) -
GUAVA: Generalizable Upper Body 3D Gaussian Avatar
par: Zhang, Dongbin, et autres
Publié: (2025)