VASA-3D: Lifelike Audio-Driven Gaussian Head Avatars from a Single Image
Fuente:
arXiv
Saved in:
| Main Authors: | Xu, Sicheng, Chen, Guojun, Yang, Jiaolong, Zhang, Yizhong, Deng, Yu, Lin, Steve, Guo, Baining |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
VASA-1: Lifelike Audio-Driven Talking Faces Generated in Real Time
by: Xu, Sicheng, et al.
Published: (2024)
by: Xu, Sicheng, et al.
Published: (2024)
Real-Time Generation of Streamable Talking Portrait Video with Reference-Guided Deep Compression VAEs
by: Xu, Sicheng, et al.
Published: (2026)
by: Xu, Sicheng, et al.
Published: (2026)
Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis
by: Zhang, Bowen, et al.
Published: (2025)
by: Zhang, Bowen, et al.
Published: (2025)
UniAvatar: Taming Lifelike Audio-Driven Talking Head Generation with Comprehensive Motion and Lighting Control
by: Sun, Wenzhang, et al.
Published: (2024)
by: Sun, Wenzhang, et al.
Published: (2024)
Audio-Driven Universal Gaussian Head Avatars
by: Teotia, Kartik, et al.
Published: (2025)
by: Teotia, Kartik, et al.
Published: (2025)
JoyVASA: Portrait and Animal Image Animation with Diffusion-Based Audio-Driven Facial Dynamics and Head Motion Generation
by: Cao, Xuyang, et al.
Published: (2024)
by: Cao, Xuyang, et al.
Published: (2024)
SEGA: Drivable 3D Gaussian Head Avatar from a Single Image
by: Guo, Chen, et al.
Published: (2025)
by: Guo, Chen, et al.
Published: (2025)
RodinHD: High-Fidelity 3D Avatar Generation with Diffusion Models
by: Zhang, Bowen, et al.
Published: (2024)
by: Zhang, Bowen, et al.
Published: (2024)
Generalizable and Animatable 3D Full-Head Gaussian Avatar from a Single Image
by: Zhao, Shuling, et al.
Published: (2026)
by: Zhao, Shuling, et al.
Published: (2026)
TaoAvatar: Real-Time Lifelike Full-Body Talking Avatars for Augmented Reality via 3D Gaussian Splatting
by: Chen, Jianchuan, et al.
Published: (2025)
by: Chen, Jianchuan, et al.
Published: (2025)
ESGaussianFace: Emotional and Stylized Audio-Driven Facial Animation via 3D Gaussian Splatting
by: Ma, Chuhang, et al.
Published: (2026)
by: Ma, Chuhang, et al.
Published: (2026)
GaussianAvatars: Photorealistic Head Avatars with Rigged 3D Gaussians
by: Qian, Shenhan, et al.
Published: (2023)
by: Qian, Shenhan, et al.
Published: (2023)
GaussianCube: A Structured and Explicit Radiance Representation for 3D Generative Modeling
by: Zhang, Bowen, et al.
Published: (2024)
by: Zhang, Bowen, et al.
Published: (2024)
HeadStudio: Text to Animatable Head Avatars with 3D Gaussian Splatting
by: Zhou, Zhenglin, et al.
Published: (2024)
by: Zhou, Zhenglin, et al.
Published: (2024)
Generating Editable Head Avatars with 3D Gaussian GANs
by: Li, Guohao, et al.
Published: (2024)
by: Li, Guohao, et al.
Published: (2024)
HeadGAP: Few-Shot 3D Head Avatar via Generalizable Gaussian Priors
by: Zheng, Xiaozheng, et al.
Published: (2024)
by: Zheng, Xiaozheng, et al.
Published: (2024)
GraphAvatar: Compact Head Avatars with GNN-Generated 3D Gaussians
by: Wei, Xiaobao, et al.
Published: (2024)
by: Wei, Xiaobao, et al.
Published: (2024)
GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
by: Agarwal, Madhav, et al.
Published: (2025)
by: Agarwal, Madhav, et al.
Published: (2025)
ALIVE: Animate Your World with Lifelike Audio-Video Generation
by: Guo, Ying, et al.
Published: (2026)
by: Guo, Ying, et al.
Published: (2026)
3D Gaussian Blendshapes for Head Avatar Animation
by: Ma, Shengjie, et al.
Published: (2024)
by: Ma, Shengjie, et al.
Published: (2024)
OMG-Avatar: One-shot Multi-LOD Gaussian Head Avatar
by: Ren, Jianqiang, et al.
Published: (2026)
by: Ren, Jianqiang, et al.
Published: (2026)
Structured 3D Latents for Scalable and Versatile 3D Generation
by: Xiang, Jianfeng, et al.
Published: (2024)
by: Xiang, Jianfeng, et al.
Published: (2024)
MixedGaussianAvatar: Realistically and Geometrically Accurate Head Avatar via Mixed 2D-3D Gaussians
by: Chen, Peng, et al.
Published: (2024)
by: Chen, Peng, et al.
Published: (2024)
MoGe: Unlocking Accurate Monocular Geometry Estimation for Open-Domain Images with Optimal Training Supervision
by: Wang, Ruicheng, et al.
Published: (2024)
by: Wang, Ruicheng, et al.
Published: (2024)
EchoMimic: Lifelike Audio-Driven Portrait Animations through Editable Landmark Conditions
by: Chen, Zhiyuan, et al.
Published: (2024)
by: Chen, Zhiyuan, et al.
Published: (2024)
GaussianHead: High-fidelity Head Avatars with Learnable Gaussian Derivation
by: Wang, Jie, et al.
Published: (2023)
by: Wang, Jie, et al.
Published: (2023)
Supervising 3D Talking Head Avatars with Analysis-by-Audio-Synthesis
by: Daněček, Radek, et al.
Published: (2025)
by: Daněček, Radek, et al.
Published: (2025)
HiSpatial: Taming Hierarchical 3D Spatial Understanding in Vision-Language Models
by: Liang, Huizhi, et al.
Published: (2026)
by: Liang, Huizhi, et al.
Published: (2026)
Tri$^{2}$-plane: Thinking Head Avatar via Feature Pyramid
by: Song, Luchuan, et al.
Published: (2024)
by: Song, Luchuan, et al.
Published: (2024)
ArchitectHead: Continuous Level of Detail Control for 3D Gaussian Head Avatars
by: Yan, Peizhi, et al.
Published: (2025)
by: Yan, Peizhi, et al.
Published: (2025)
FlashAvatar: High-fidelity Head Avatar with Efficient Gaussian Embedding
by: Xiang, Jun, et al.
Published: (2023)
by: Xiang, Jun, et al.
Published: (2023)
Event-Driven Storytelling with Multiple Lifelike Humans in a 3D Scene
by: Lim, Donggeun, et al.
Published: (2025)
by: Lim, Donggeun, et al.
Published: (2025)
GeoAvatar: Adaptive Geometrical Gaussian Splatting for 3D Head Avatar
by: Moon, SeungJun, et al.
Published: (2025)
by: Moon, SeungJun, et al.
Published: (2025)
HRAvatar: High-Quality and Relightable Gaussian Head Avatar
by: Zhang, Dongbin, et al.
Published: (2025)
by: Zhang, Dongbin, et al.
Published: (2025)
GaussianSpeech: Audio-Driven Gaussian Avatars
by: Aneja, Shivangi, et al.
Published: (2024)
by: Aneja, Shivangi, et al.
Published: (2024)
GaussianAvatar-Editor: Photorealistic Animatable Gaussian Head Avatar Editor
by: Liu, Xiangyue, et al.
Published: (2025)
by: Liu, Xiangyue, et al.
Published: (2025)
GPAvatar: Generalizable and Precise Head Avatar from Image(s)
by: Chu, Xuangeng, et al.
Published: (2024)
by: Chu, Xuangeng, et al.
Published: (2024)
GGAvatar: Geometric Adjustment of Gaussian Head Avatar
by: Li, Xinyang, et al.
Published: (2024)
by: Li, Xinyang, et al.
Published: (2024)
HeadGaS: Real-Time Animatable Head Avatars via 3D Gaussian Splatting
by: Dhamo, Helisa, et al.
Published: (2023)
by: Dhamo, Helisa, et al.
Published: (2023)
GPHM: Gaussian Parametric Head Model for Monocular Head Avatar Reconstruction
by: Xu, Yuelang, et al.
Published: (2024)
by: Xu, Yuelang, et al.
Published: (2024)
Similar Items
-
VASA-1: Lifelike Audio-Driven Talking Faces Generated in Real Time
by: Xu, Sicheng, et al.
Published: (2024) -
Real-Time Generation of Streamable Talking Portrait Video with Reference-Guided Deep Compression VAEs
by: Xu, Sicheng, et al.
Published: (2026) -
Gaussian Variation Field Diffusion for High-fidelity Video-to-4D Synthesis
by: Zhang, Bowen, et al.
Published: (2025) -
UniAvatar: Taming Lifelike Audio-Driven Talking Head Generation with Comprehensive Motion and Lighting Control
by: Sun, Wenzhang, et al.
Published: (2024) -
Audio-Driven Universal Gaussian Head Avatars
by: Teotia, Kartik, et al.
Published: (2025)