One Shot, One Talk: Whole-body Talking Avatar from a Single Image
Fuente:
arXiv
Saved in:
| Main Authors: | Xiang, Jun, Guo, Yudong, Hu, Leipeng, Guo, Boyang, Yuan, Yancheng, Zhang, Juyong |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
FlashAvatar: High-fidelity Head Avatar with Efficient Gaussian Embedding
by: Xiang, Jun, et al.
Published: (2023)
by: Xiang, Jun, et al.
Published: (2023)
ExpPortrait: Expressive Portrait Generation via Personalized Representation
by: Wang, Junyi, et al.
Published: (2026)
by: Wang, Junyi, et al.
Published: (2026)
Hybrid Explicit Representation for Ultra-Realistic Head Avatars
by: Cai, Hongrui, et al.
Published: (2024)
by: Cai, Hongrui, et al.
Published: (2024)
ProgressiveAvatars: Progressive Animatable 3D Gaussian Avatars
by: Song, Kaiwen, et al.
Published: (2026)
by: Song, Kaiwen, et al.
Published: (2026)
Supervising 3D Talking Head Avatars with Analysis-by-Audio-Synthesis
by: Daněček, Radek, et al.
Published: (2025)
by: Daněček, Radek, et al.
Published: (2025)
OT-Talk: Animating 3D Talking Head with Optimal Transportation
by: Wang, Xinmu, et al.
Published: (2025)
by: Wang, Xinmu, et al.
Published: (2025)
Portrait Video Editing Empowered by Multimodal Generative Priors
by: Gao, Xuan, et al.
Published: (2024)
by: Gao, Xuan, et al.
Published: (2024)
Controlling Avatar Diffusion with Learnable Gaussian Embedding
by: Gao, Xuan, et al.
Published: (2025)
by: Gao, Xuan, et al.
Published: (2025)
OMEGA-Avatar: One-shot Modeling of 360° Gaussian Avatars
by: Xia, Zehao, et al.
Published: (2026)
by: Xia, Zehao, et al.
Published: (2026)
DynamicAvatars: Accurate Dynamic Facial Avatars Reconstruction and Precise Editing with Diffusion Models
by: Qian, Yangyang, et al.
Published: (2024)
by: Qian, Yangyang, et al.
Published: (2024)
MultiTalk: Enhancing 3D Talking Head Generation Across Languages with Multilingual Video Dataset
by: Sung-Bin, Kim, et al.
Published: (2024)
by: Sung-Bin, Kim, et al.
Published: (2024)
Learn2Talk: 3D Talking Face Learns from 2D Talking Face
by: Zhuang, Yixiang, et al.
Published: (2024)
by: Zhuang, Yixiang, et al.
Published: (2024)
SEGA: Drivable 3D Gaussian Head Avatar from a Single Image
by: Guo, Chen, et al.
Published: (2025)
by: Guo, Chen, et al.
Published: (2025)
EgoAvatar: Egocentric View-Driven and Photorealistic Full-body Avatars
by: Chen, Jianchun, et al.
Published: (2024)
by: Chen, Jianchun, et al.
Published: (2024)
PASE: Phoneme-Aware Speech Encoder to Improve Lip Sync Accuracy for Talking Head Synthesis
by: Huang, Yihuan, et al.
Published: (2025)
by: Huang, Yihuan, et al.
Published: (2025)
PersonaTalk: Bring Attention to Your Persona in Visual Dubbing
by: Zhang, Longhao, et al.
Published: (2024)
by: Zhang, Longhao, et al.
Published: (2024)
One-Shot Real-to-Sim via End-to-End Differentiable Simulation and Rendering
by: Zhu, Yifan, et al.
Published: (2024)
by: Zhu, Yifan, et al.
Published: (2024)
StyGazeTalk: Learning Stylized Generation of Gaze and Head Dynamics
by: Shi, Chengwei, et al.
Published: (2025)
by: Shi, Chengwei, et al.
Published: (2025)
MoDA: Multi-modal Diffusion Architecture for Talking Head Generation
by: Li, Xinyang, et al.
Published: (2025)
by: Li, Xinyang, et al.
Published: (2025)
Capture, Canonicalize, Splat: Zero-Shot 3D Gaussian Avatars from Unstructured Phone Images
by: Garbin, Emanuel, et al.
Published: (2025)
by: Garbin, Emanuel, et al.
Published: (2025)
Next-Scale Autoregressive Models are Zero-Shot Single-Image Object View Synthesizers
by: Yuan, Shiran, et al.
Published: (2025)
by: Yuan, Shiran, et al.
Published: (2025)
Part123: Part-aware 3D Reconstruction from a Single-view Image
by: Liu, Anran, et al.
Published: (2024)
by: Liu, Anran, et al.
Published: (2024)
PhysTalk: Language-driven Real-time Physics in 3D Gaussian Scenes
by: Collorone, Luca, et al.
Published: (2025)
by: Collorone, Luca, et al.
Published: (2025)
Neural-ABC: Neural Parametric Models for Articulated Body with Clothes
by: Chen, Honghu, et al.
Published: (2024)
by: Chen, Honghu, et al.
Published: (2024)
Scalable and High-Quality Neural Implicit Representation for 3D Reconstruction
by: Yang, Leyuan, et al.
Published: (2025)
by: Yang, Leyuan, et al.
Published: (2025)
End-to-end Surface Optimization for Light Control
by: Sun, Yuou, et al.
Published: (2024)
by: Sun, Yuou, et al.
Published: (2024)
ZeroScene: A Zero-Shot Framework for 3D Scene Generation from a Single Image and Controllable Texture Editing
by: Tang, Xiang, et al.
Published: (2025)
by: Tang, Xiang, et al.
Published: (2025)
STGA: Selective-Training Gaussian Head Avatars
by: Guo, Hanzhi, et al.
Published: (2025)
by: Guo, Hanzhi, et al.
Published: (2025)
D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video
by: Chen, Honghu, et al.
Published: (2025)
by: Chen, Honghu, et al.
Published: (2025)
PhysAvatar: Learning the Physics of Dressed 3D Avatars from Visual Observations
by: Zheng, Yang, et al.
Published: (2024)
by: Zheng, Yang, et al.
Published: (2024)
One-Step Image Translation with Text-to-Image Models
by: Parmar, Gaurav, et al.
Published: (2024)
by: Parmar, Gaurav, et al.
Published: (2024)
Perceptually Accurate 3D Talking Head Generation: New Definitions, Speech-Mesh Representation, and Evaluation Metrics
by: Chae-Yeon, Lee, et al.
Published: (2025)
by: Chae-Yeon, Lee, et al.
Published: (2025)
Large-scale Codec Avatars: The Unreasonable Effectiveness of Large-scale Avatar Pretraining
by: Li, Junxuan, et al.
Published: (2026)
by: Li, Junxuan, et al.
Published: (2026)
SOAR: Self-Occluded Avatar Recovery from a Single Video In the Wild
by: Pan, Zhuoyang, et al.
Published: (2024)
by: Pan, Zhuoyang, et al.
Published: (2024)
HandOS: 3D Hand Reconstruction in One Stage
by: Chen, Xingyu, et al.
Published: (2024)
by: Chen, Xingyu, et al.
Published: (2024)
ZeroNVS: Zero-Shot 360-Degree View Synthesis from a Single Image
by: Sargent, Kyle, et al.
Published: (2023)
by: Sargent, Kyle, et al.
Published: (2023)
SPARE: Symmetrized Point-to-Plane Distance for Robust Non-Rigid 3D Registration
by: Yao, Yuxin, et al.
Published: (2024)
by: Yao, Yuxin, et al.
Published: (2024)
City-on-Web: Real-time Neural Rendering of Large-scale Scenes on the Web
by: Song, Kaiwen, et al.
Published: (2023)
by: Song, Kaiwen, et al.
Published: (2023)
Shape from Semantics: 3D Shape Generation from Multi-View Semantics
by: Li, Liangchen, et al.
Published: (2025)
by: Li, Liangchen, et al.
Published: (2025)
TextToon: Real-Time Text Toonify Head Avatar from Single Video
by: Song, Luchuan, et al.
Published: (2024)
by: Song, Luchuan, et al.
Published: (2024)
Similar Items
-
FlashAvatar: High-fidelity Head Avatar with Efficient Gaussian Embedding
by: Xiang, Jun, et al.
Published: (2023) -
ExpPortrait: Expressive Portrait Generation via Personalized Representation
by: Wang, Junyi, et al.
Published: (2026) -
Hybrid Explicit Representation for Ultra-Realistic Head Avatars
by: Cai, Hongrui, et al.
Published: (2024) -
ProgressiveAvatars: Progressive Animatable 3D Gaussian Avatars
by: Song, Kaiwen, et al.
Published: (2026) -
Supervising 3D Talking Head Avatars with Analysis-by-Audio-Synthesis
by: Daněček, Radek, et al.
Published: (2025)