HunyuanVideo-Avatar: High-Fidelity Audio-Driven Human Animation for Multiple Characters
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Yi, Liang, Sen, Zhou, Zixiang, Huang, Ziyao, Ma, Yifeng, Tang, Junshu, Lin, Qin, Zhou, Yuan, Lu, Qinglin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HunyuanVideo-HOMA: Generic Human-Object Interaction in Multimodal Driven Human Animation
di: Huang, Ziyao, et al.
Pubblicazione: (2025)
di: Huang, Ziyao, et al.
Pubblicazione: (2025)
HunyuanVideo-Foley: Multimodal Diffusion with Representation Alignment for High-Fidelity Foley Audio Generation
di: Shan, Sizhe, et al.
Pubblicazione: (2025)
di: Shan, Sizhe, et al.
Pubblicazione: (2025)
HunyuanVideo 1.5 Technical Report
di: Wu, Bing, et al.
Pubblicazione: (2025)
di: Wu, Bing, et al.
Pubblicazione: (2025)
HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation
di: Hu, Teng, et al.
Pubblicazione: (2025)
di: Hu, Teng, et al.
Pubblicazione: (2025)
HunyuanVideo: A Systematic Framework For Large Video Generative Models
di: Kong, Weijie, et al.
Pubblicazione: (2024)
di: Kong, Weijie, et al.
Pubblicazione: (2024)
Making Avatars Interact: Towards Text-Driven Human-Object Interaction for Controllable Talking Avatars
di: Zhang, Youliang, et al.
Pubblicazione: (2026)
di: Zhang, Youliang, et al.
Pubblicazione: (2026)
HunyuanPortrait: Implicit Condition Control for Enhanced Portrait Animation
di: Xu, Zunnan, et al.
Pubblicazione: (2025)
di: Xu, Zunnan, et al.
Pubblicazione: (2025)
Hunyuan-GameCraft: High-dynamic Interactive Game Video Generation with Hybrid History Condition
di: Li, Jiaqi, et al.
Pubblicazione: (2025)
di: Li, Jiaqi, et al.
Pubblicazione: (2025)
StreamAvatar: Streaming Diffusion Models for Real-Time Interactive Human Avatars
di: Sun, Zhiyao, et al.
Pubblicazione: (2025)
di: Sun, Zhiyao, et al.
Pubblicazione: (2025)
ActAvatar: Temporally-Aware Precise Action Control for Talking Avatars
di: Peng, Ziqiao, et al.
Pubblicazione: (2025)
di: Peng, Ziqiao, et al.
Pubblicazione: (2025)
Hunyuan-GameCraft-2: Instruction-following Interactive Game World Model
di: Tang, Junshu, et al.
Pubblicazione: (2025)
di: Tang, Junshu, et al.
Pubblicazione: (2025)
OmniAvatar: Efficient Audio-Driven Avatar Video Generation with Adaptive Body Animation
di: Gan, Qijun, et al.
Pubblicazione: (2025)
di: Gan, Qijun, et al.
Pubblicazione: (2025)
UniAVGen: Unified Audio and Video Generation with Asymmetric Cross-Modal Interactions
di: Zhang, Guozhen, et al.
Pubblicazione: (2025)
di: Zhang, Guozhen, et al.
Pubblicazione: (2025)
Lookahead Anchoring: Preserving Character Identity in Audio-Driven Human Animation
di: Seo, Junyoung, et al.
Pubblicazione: (2025)
di: Seo, Junyoung, et al.
Pubblicazione: (2025)
Make-It-Vivid: Dressing Your Animatable Biped Cartoon Characters from Text
di: Tang, Junshu, et al.
Pubblicazione: (2024)
di: Tang, Junshu, et al.
Pubblicazione: (2024)
AlignHuman: Improving Motion and Fidelity via Timestep-Segment Preference Optimization for Audio-Driven Human Animation
di: Liang, Chao, et al.
Pubblicazione: (2025)
di: Liang, Chao, et al.
Pubblicazione: (2025)
Audio-visual Controlled Video Diffusion with Masked Selective State Spaces Modeling for Natural Talking Head Generation
di: Hong, Fa-Ting, et al.
Pubblicazione: (2025)
di: Hong, Fa-Ting, et al.
Pubblicazione: (2025)
Video-Driven Animation of Neural Head Avatars
di: Paier, Wolfgang, et al.
Pubblicazione: (2024)
di: Paier, Wolfgang, et al.
Pubblicazione: (2024)
Animatable 3D Gaussian: Fast and High-Quality Reconstruction of Multiple Human Avatars
di: Liu, Yang, et al.
Pubblicazione: (2023)
di: Liu, Yang, et al.
Pubblicazione: (2023)
AnimationBench: Are Video Models Good at Character-Centric Animation?
di: Wu, Leyi, et al.
Pubblicazione: (2026)
di: Wu, Leyi, et al.
Pubblicazione: (2026)
GaussianAvatar: Towards Realistic Human Avatar Modeling from a Single Video via Animatable 3D Gaussians
di: Hu, Liangxiao, et al.
Pubblicazione: (2023)
di: Hu, Liangxiao, et al.
Pubblicazione: (2023)
Euphonium: Steering Video Flow Matching via Process Reward Gradient Guided Stochastic Dynamics
di: Zhong, Ruizhe, et al.
Pubblicazione: (2026)
di: Zhong, Ruizhe, et al.
Pubblicazione: (2026)
Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance
di: Hu, Li, et al.
Pubblicazione: (2025)
di: Hu, Li, et al.
Pubblicazione: (2025)
3D Gaussian Blendshapes for Head Avatar Animation
di: Ma, Shengjie, et al.
Pubblicazione: (2024)
di: Ma, Shengjie, et al.
Pubblicazione: (2024)
StableAvatar: Infinite-Length Audio-Driven Avatar Video Generation
di: Tu, Shuyuan, et al.
Pubblicazione: (2025)
di: Tu, Shuyuan, et al.
Pubblicazione: (2025)
A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation
di: Zhou, S. Z., et al.
Pubblicazione: (2025)
di: Zhou, S. Z., et al.
Pubblicazione: (2025)
Harmony: Harmonizing Audio and Video Generation through Cross-Task Synergy
di: Hu, Teng, et al.
Pubblicazione: (2025)
di: Hu, Teng, et al.
Pubblicazione: (2025)
Human Gaussian Splatting: Real-time Rendering of Animatable Avatars
di: Moreau, Arthur, et al.
Pubblicazione: (2023)
di: Moreau, Arthur, et al.
Pubblicazione: (2023)
HeadStudio: Text to Animatable Head Avatars with 3D Gaussian Splatting
di: Zhou, Zhenglin, et al.
Pubblicazione: (2024)
di: Zhou, Zhenglin, et al.
Pubblicazione: (2024)
AHA! Animating Human Avatars in Diverse Scenes with Gaussian Splatting
di: Mir, Aymen, et al.
Pubblicazione: (2025)
di: Mir, Aymen, et al.
Pubblicazione: (2025)
Zero-1-to-A: Zero-Shot One Image to Animatable Head Avatars Using Video Diffusion
di: Zhou, Zhenglin, et al.
Pubblicazione: (2025)
di: Zhou, Zhenglin, et al.
Pubblicazione: (2025)
VidAnimator: User-Guided Stylized 3D Character Animation from Human Videos
di: Ye, Xinwu, et al.
Pubblicazione: (2025)
di: Ye, Xinwu, et al.
Pubblicazione: (2025)
Sonic: Shifting Focus to Global Audio Perception in Portrait Animation
di: Ji, Xiaozhong, et al.
Pubblicazione: (2024)
di: Ji, Xiaozhong, et al.
Pubblicazione: (2024)
MirrorMe: Towards Realtime and High Fidelity Audio-Driven Halfbody Animation
di: Meng, Dechao, et al.
Pubblicazione: (2025)
di: Meng, Dechao, et al.
Pubblicazione: (2025)
STG-Avatar: Animatable Human Avatars via Spacetime Gaussian
di: Jiang, Guangan, et al.
Pubblicazione: (2025)
di: Jiang, Guangan, et al.
Pubblicazione: (2025)
Make-It-Animatable: An Efficient Framework for Authoring Animation-Ready 3D Characters
di: Guo, Zhiyang, et al.
Pubblicazione: (2024)
di: Guo, Zhiyang, et al.
Pubblicazione: (2024)
Hunyuan-Game: Industrial-grade Intelligent Game Creation Model
di: Li, Ruihuang, et al.
Pubblicazione: (2025)
di: Li, Ruihuang, et al.
Pubblicazione: (2025)
GaussianAvatar-Editor: Photorealistic Animatable Gaussian Head Avatar Editor
di: Liu, Xiangyue, et al.
Pubblicazione: (2025)
di: Liu, Xiangyue, et al.
Pubblicazione: (2025)
Deblur-Avatar: Animatable Avatars from Motion-Blurred Monocular Videos
di: Luo, Xianrui, et al.
Pubblicazione: (2025)
di: Luo, Xianrui, et al.
Pubblicazione: (2025)
Playmate2: Training-Free Multi-Character Audio-Driven Animation via Diffusion Transformer with Reward Feedback
di: Ma, Xingpei, et al.
Pubblicazione: (2025)
di: Ma, Xingpei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
HunyuanVideo-HOMA: Generic Human-Object Interaction in Multimodal Driven Human Animation
di: Huang, Ziyao, et al.
Pubblicazione: (2025) -
HunyuanVideo-Foley: Multimodal Diffusion with Representation Alignment for High-Fidelity Foley Audio Generation
di: Shan, Sizhe, et al.
Pubblicazione: (2025) -
HunyuanVideo 1.5 Technical Report
di: Wu, Bing, et al.
Pubblicazione: (2025) -
HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation
di: Hu, Teng, et al.
Pubblicazione: (2025) -
HunyuanVideo: A Systematic Framework For Large Video Generative Models
di: Kong, Weijie, et al.
Pubblicazione: (2024)