Live Avatar: Streaming Real-time Audio-Driven Avatar Generation with Infinite Length
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Yubo, Guo, Hailong, Wu, Fangtai, Wang, Weiqiang, Zhang, Shifeng, Huang, Shijie, Gan, Qijun, Liu, Lin, Zhao, Sirui, Chen, Enhong, Liu, Jiaming, Hoi, Steven |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
OmniAvatar: Efficient Audio-Driven Avatar Video Generation with Adaptive Body Animation
di: Gan, Qijun, et al.
Pubblicazione: (2025)
di: Gan, Qijun, et al.
Pubblicazione: (2025)
StableAvatar: Infinite-Length Audio-Driven Avatar Video Generation
di: Tu, Shuyuan, et al.
Pubblicazione: (2025)
di: Tu, Shuyuan, et al.
Pubblicazione: (2025)
Bind-Your-Avatar: Multi-Talking-Character Video Generation with Dynamic 3D-mask-based Embedding Router
di: Huang, Yubo, et al.
Pubblicazione: (2025)
di: Huang, Yubo, et al.
Pubblicazione: (2025)
XHand: Real-time Expressive Hand Avatar
di: Gan, Qijun, et al.
Pubblicazione: (2024)
di: Gan, Qijun, et al.
Pubblicazione: (2024)
OMG-Avatar: One-shot Multi-LOD Gaussian Head Avatar
di: Ren, Jianqiang, et al.
Pubblicazione: (2026)
di: Ren, Jianqiang, et al.
Pubblicazione: (2026)
JoyStreamer-Flash: Real-time and Infinite Audio-Driven Avatar Generation with Autoregressive Diffusion
di: Li, Chaochao, et al.
Pubblicazione: (2025)
di: Li, Chaochao, et al.
Pubblicazione: (2025)
SoulX-FlashTalk: Real-Time Infinite Streaming of Audio-Driven Avatars via Self-Correcting Bidirectional Distillation
di: Shen, Le, et al.
Pubblicazione: (2025)
di: Shen, Le, et al.
Pubblicazione: (2025)
StreamAvatar: Streaming Diffusion Models for Real-Time Interactive Human Avatars
di: Sun, Zhiyao, et al.
Pubblicazione: (2025)
di: Sun, Zhiyao, et al.
Pubblicazione: (2025)
UniLS: End-to-End Audio-Driven Avatars for Unified Listening and Speaking
di: Chu, Xuangeng, et al.
Pubblicazione: (2025)
di: Chu, Xuangeng, et al.
Pubblicazione: (2025)
Nods of Agreement: Webcam-Driven Avatars Improve Meeting Outcomes and Avatar Satisfaction Over Audio-Driven or Static Avatars in All-Avatar Work Videoconferencing
di: Ma, Fang, et al.
Pubblicazione: (2024)
di: Ma, Fang, et al.
Pubblicazione: (2024)
Hallo-Live: Real-Time Streaming Joint Audio-Video Avatar Generation with Asynchronous Dual-Stream and Human-Centric Preference Distillation
di: Li, Chunyu, et al.
Pubblicazione: (2026)
di: Li, Chunyu, et al.
Pubblicazione: (2026)
MeshLAM: Feed-Forward One-Shot Animatable Textured Mesh Avatar Reconstruction
di: He, Yisheng, et al.
Pubblicazione: (2026)
di: He, Yisheng, et al.
Pubblicazione: (2026)
Audio-Driven Universal Gaussian Head Avatars
di: Teotia, Kartik, et al.
Pubblicazione: (2025)
di: Teotia, Kartik, et al.
Pubblicazione: (2025)
GaussianSpeech: Audio-Driven Gaussian Avatars
di: Aneja, Shivangi, et al.
Pubblicazione: (2024)
di: Aneja, Shivangi, et al.
Pubblicazione: (2024)
StreamME: Simplify 3D Gaussian Avatar within Live Stream
di: Song, Luchuan, et al.
Pubblicazione: (2025)
di: Song, Luchuan, et al.
Pubblicazione: (2025)
ViSA: 3D-Aware Video Shading for Real-Time Upper-Body Avatar Creation
di: Yang, Fan, et al.
Pubblicazione: (2025)
di: Yang, Fan, et al.
Pubblicazione: (2025)
DNF-Avatar: Distilling Neural Fields for Real-time Animatable Avatar Relighting
di: Jiang, Zeren, et al.
Pubblicazione: (2025)
di: Jiang, Zeren, et al.
Pubblicazione: (2025)
WildAvatar: Learning In-the-wild 3D Avatars from the Web
di: Huang, Zihao, et al.
Pubblicazione: (2024)
di: Huang, Zihao, et al.
Pubblicazione: (2024)
AvatarForcing: One-Step Streaming Talking Avatars via Local-Future Sliding-Window Denoising
di: Cui, Liyuan, et al.
Pubblicazione: (2026)
di: Cui, Liyuan, et al.
Pubblicazione: (2026)
SelfieAvatar: Real-time Head Avatar reenactment from a Selfie Video
di: Liang, Wei, et al.
Pubblicazione: (2026)
di: Liang, Wei, et al.
Pubblicazione: (2026)
HunyuanVideo-Avatar: High-Fidelity Audio-Driven Human Animation for Multiple Characters
di: Chen, Yi, et al.
Pubblicazione: (2025)
di: Chen, Yi, et al.
Pubblicazione: (2025)
TurboTalk: Progressive Distillation for One-Step Audio-Driven Talking Avatar Generation
di: Liu, Xiangyu, et al.
Pubblicazione: (2026)
di: Liu, Xiangyu, et al.
Pubblicazione: (2026)
SmartAvatar: Text- and Image-Guided Human Avatar Generation with VLM AI Agents
di: Huang-Menders, Alexander, et al.
Pubblicazione: (2025)
di: Huang-Menders, Alexander, et al.
Pubblicazione: (2025)
EgoAvatar: Egocentric View-Driven and Photorealistic Full-body Avatars
di: Chen, Jianchun, et al.
Pubblicazione: (2024)
di: Chen, Jianchun, et al.
Pubblicazione: (2024)
Making Avatars Interact: Towards Text-Driven Human-Object Interaction for Controllable Talking Avatars
di: Zhang, Youliang, et al.
Pubblicazione: (2026)
di: Zhang, Youliang, et al.
Pubblicazione: (2026)
LightAvatar: Efficient Head Avatar as Dynamic Neural Light Field
di: Wang, Huan, et al.
Pubblicazione: (2024)
di: Wang, Huan, et al.
Pubblicazione: (2024)
InfiniteAudio: Infinite-Length Audio Generation with Consistency
di: Jung, Chaeyoung, et al.
Pubblicazione: (2025)
di: Jung, Chaeyoung, et al.
Pubblicazione: (2025)
AvatarPointillist: AutoRegressive 4D Gaussian Avatarization
di: Liu, Hongyu, et al.
Pubblicazione: (2026)
di: Liu, Hongyu, et al.
Pubblicazione: (2026)
Avatar Forcing: Real-Time Interactive Head Avatar Generation for Natural Conversation
di: Ki, Taekyung, et al.
Pubblicazione: (2026)
di: Ki, Taekyung, et al.
Pubblicazione: (2026)
GaussianAvatar-Editor: Photorealistic Animatable Gaussian Head Avatar Editor
di: Liu, Xiangyue, et al.
Pubblicazione: (2025)
di: Liu, Xiangyue, et al.
Pubblicazione: (2025)
HRM^2Avatar: High-Fidelity Real-Time Mobile Avatars from Monocular Phone Scans
di: Shi, Chao, et al.
Pubblicazione: (2025)
di: Shi, Chao, et al.
Pubblicazione: (2025)
InvertAvatar: Incremental GAN Inversion for Generalized Head Avatars
di: Zhao, Xiaochen, et al.
Pubblicazione: (2023)
di: Zhao, Xiaochen, et al.
Pubblicazione: (2023)
Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency
di: Jiang, Jianwen, et al.
Pubblicazione: (2024)
di: Jiang, Jianwen, et al.
Pubblicazione: (2024)
EMO2: End-Effector Guided Audio-Driven Avatar Video Generation
di: Tian, Linrui, et al.
Pubblicazione: (2025)
di: Tian, Linrui, et al.
Pubblicazione: (2025)
A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation
di: Zhou, S. Z., et al.
Pubblicazione: (2025)
di: Zhou, S. Z., et al.
Pubblicazione: (2025)
Motion Avatar: Generate Human and Animal Avatars with Arbitrary Motion
di: Zhang, Zeyu, et al.
Pubblicazione: (2024)
di: Zhang, Zeyu, et al.
Pubblicazione: (2024)
AvatarArtist: Open-Domain 4D Avatarization
di: Liu, Hongyu, et al.
Pubblicazione: (2025)
di: Liu, Hongyu, et al.
Pubblicazione: (2025)
OMEGA-Avatar: One-shot Modeling of 360° Gaussian Avatars
di: Xia, Zehao, et al.
Pubblicazione: (2026)
di: Xia, Zehao, et al.
Pubblicazione: (2026)
Audio2Face-3D: Audio-driven Realistic Facial Animation For Digital Avatars
di: NVIDIA, et al.
Pubblicazione: (2025)
di: NVIDIA, et al.
Pubblicazione: (2025)
ReliaAvatar: A Robust Real-Time Avatar Animator with Integrated Motion Prediction
di: Qian, Bo, et al.
Pubblicazione: (2024)
di: Qian, Bo, et al.
Pubblicazione: (2024)
Documenti analoghi
-
OmniAvatar: Efficient Audio-Driven Avatar Video Generation with Adaptive Body Animation
di: Gan, Qijun, et al.
Pubblicazione: (2025) -
StableAvatar: Infinite-Length Audio-Driven Avatar Video Generation
di: Tu, Shuyuan, et al.
Pubblicazione: (2025) -
Bind-Your-Avatar: Multi-Talking-Character Video Generation with Dynamic 3D-mask-based Embedding Router
di: Huang, Yubo, et al.
Pubblicazione: (2025) -
XHand: Real-time Expressive Hand Avatar
di: Gan, Qijun, et al.
Pubblicazione: (2024) -
OMG-Avatar: One-shot Multi-LOD Gaussian Head Avatar
di: Ren, Jianqiang, et al.
Pubblicazione: (2026)