EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions
Fuente:
arXiv
Guardado en:
| Autores principales: | Tian, Linrui, Wang, Qi, Zhang, Bang, Bo, Liefeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
EMO2: End-Effector Guided Audio-Driven Avatar Video Generation
por: Tian, Linrui, et al.
Publicado: (2025)
por: Tian, Linrui, et al.
Publicado: (2025)
ChatAnyone: Stylized Real-time Portrait Video Generation with Hierarchical Motion Diffusion Model
por: Qi, Jinwei, et al.
Publicado: (2025)
por: Qi, Jinwei, et al.
Publicado: (2025)
Controllable and Expressive One-Shot Video Head Swapping
por: Ji, Chaonan, et al.
Publicado: (2025)
por: Ji, Chaonan, et al.
Publicado: (2025)
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
por: Fei, Zhengcong, et al.
Publicado: (2025)
por: Fei, Zhengcong, et al.
Publicado: (2025)
CartoonAlive: Towards Expressive Live2D Modeling from Single Portraits
por: He, Chao, et al.
Publicado: (2025)
por: He, Chao, et al.
Publicado: (2025)
Real-time One-Step Diffusion-based Expressive Portrait Videos Generation
por: Guo, Hanzhong, et al.
Publicado: (2024)
por: Guo, Hanzhong, et al.
Publicado: (2024)
ExpPortrait: Expressive Portrait Generation via Personalized Representation
por: Wang, Junyi, et al.
Publicado: (2026)
por: Wang, Junyi, et al.
Publicado: (2026)
Knot Forcing: Taming Autoregressive Video Diffusion Models for Real-time Infinite Interactive Portrait Animation
por: Xiao, Steven, et al.
Publicado: (2025)
por: Xiao, Steven, et al.
Publicado: (2025)
SkyReels-A1: Expressive Portrait Animation in Video Diffusion Transformers
por: Qiu, Di, et al.
Publicado: (2025)
por: Qiu, Di, et al.
Publicado: (2025)
FlowPortrait: Reinforcement Learning for Audio-Driven Portrait Video Generation
por: Tan, Weiting, et al.
Publicado: (2026)
por: Tan, Weiting, et al.
Publicado: (2026)
V-Express: Conditional Dropout for Progressive Training of Portrait Video Generation
por: Wang, Cong, et al.
Publicado: (2024)
por: Wang, Cong, et al.
Publicado: (2024)
Stable Video Portraits
por: Ostrek, Mirela, et al.
Publicado: (2024)
por: Ostrek, Mirela, et al.
Publicado: (2024)
X-Portrait: Expressive Portrait Animation with Hierarchical Motion Attention
por: Xie, You, et al.
Publicado: (2024)
por: Xie, You, et al.
Publicado: (2024)
LLIA -- Enabling Low-Latency Interactive Avatars: Real-Time Audio-Driven Portrait Video Generation with Diffusion Models
por: Yu, Haojie, et al.
Publicado: (2025)
por: Yu, Haojie, et al.
Publicado: (2025)
UniPortrait: A Unified Framework for Identity-Preserving Single- and Multi-Human Image Personalization
por: He, Junjie, et al.
Publicado: (2024)
por: He, Junjie, et al.
Publicado: (2024)
EchoShot: Multi-Shot Portrait Video Generation
por: Wang, Jiahao, et al.
Publicado: (2025)
por: Wang, Jiahao, et al.
Publicado: (2025)
Stable Video-Driven Portraits
por: R., Mallikarjun B., et al.
Publicado: (2025)
por: R., Mallikarjun B., et al.
Publicado: (2025)
GMTalker: Gaussian Mixture-based Audio-Driven Emotional Talking Video Portraits
por: Xia, Yibo, et al.
Publicado: (2023)
por: Xia, Yibo, et al.
Publicado: (2023)
HarmoVid: Relightful Video Portrait Harmonization
por: Choi, Jun Myeong, et al.
Publicado: (2026)
por: Choi, Jun Myeong, et al.
Publicado: (2026)
X-Actor: Emotional and Expressive Long-Range Portrait Acting from Audio
por: Zhang, Chenxu, et al.
Publicado: (2025)
por: Zhang, Chenxu, et al.
Publicado: (2025)
UniTalking: A Unified Audio-Video Framework for Talking Portrait Generation
por: Li, Hebeizi, et al.
Publicado: (2026)
por: Li, Hebeizi, et al.
Publicado: (2026)
OmniTalker: One-shot Real-time Text-Driven Talking Audio-Video Generation With Multimodal Style Mimicking
por: Wang, Zhongjian, et al.
Publicado: (2025)
por: Wang, Zhongjian, et al.
Publicado: (2025)
LumiSculpt: Enabling Consistent Portrait Lighting in Video Generation
por: Zhang, Yuxin, et al.
Publicado: (2024)
por: Zhang, Yuxin, et al.
Publicado: (2024)
DeX-Portrait: Disentangled and Expressive Portrait Animation via Explicit and Latent Motion Representations
por: Shi, Yuxiang, et al.
Publicado: (2025)
por: Shi, Yuxiang, et al.
Publicado: (2025)
Portrait Video Editing Empowered by Multimodal Generative Priors
por: Gao, Xuan, et al.
Publicado: (2024)
por: Gao, Xuan, et al.
Publicado: (2024)
MegaPortrait: Revisiting Diffusion Control for High-fidelity Portrait Generation
por: Yang, Han, et al.
Publicado: (2024)
por: Yang, Han, et al.
Publicado: (2024)
FantasyPortrait: Enhancing Multi-Character Portrait Animation with Expression-Augmented Diffusion Transformers
por: Wang, Qiang, et al.
Publicado: (2025)
por: Wang, Qiang, et al.
Publicado: (2025)
RAP: Real-time Audio-driven Portrait Animation with Video Diffusion Transformer
por: Du, Fangyu, et al.
Publicado: (2025)
por: Du, Fangyu, et al.
Publicado: (2025)
A Self-supervised Motion Representation for Portrait Video Generation
por: Zhang, Qiyuan, et al.
Publicado: (2025)
por: Zhang, Qiyuan, et al.
Publicado: (2025)
Audio-visual Event Localization on Portrait Mode Short Videos
por: Liu, Wuyang, et al.
Publicado: (2025)
por: Liu, Wuyang, et al.
Publicado: (2025)
HunyuanPortrait: Implicit Condition Control for Enhanced Portrait Animation
por: Xu, Zunnan, et al.
Publicado: (2025)
por: Xu, Zunnan, et al.
Publicado: (2025)
MaTe3D: Mask-guided Text-based 3D-aware Portrait Editing
por: Zhou, Kangneng, et al.
Publicado: (2023)
por: Zhou, Kangneng, et al.
Publicado: (2023)
RASA: Replace Anyone, Say Anything -- A Training-Free Framework for Audio-Driven and Universal Portrait Video Editing
por: Pan, Tianrui, et al.
Publicado: (2025)
por: Pan, Tianrui, et al.
Publicado: (2025)
FaceCam: Portrait Video Camera Control via Scale-Aware Conditioning
por: Lyu, Weijie, et al.
Publicado: (2026)
por: Lyu, Weijie, et al.
Publicado: (2026)
AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation
por: Wei, Huawei, et al.
Publicado: (2024)
por: Wei, Huawei, et al.
Publicado: (2024)
High-Fidelity Relightable Monocular Portrait Animation with Lighting-Controllable Video Diffusion Model
por: Guo, Mingtao, et al.
Publicado: (2025)
por: Guo, Mingtao, et al.
Publicado: (2025)
PersonaLive! Expressive Portrait Image Animation for Live Streaming
por: Li, Zhiyuan, et al.
Publicado: (2025)
por: Li, Zhiyuan, et al.
Publicado: (2025)
DiffuEraser: A Diffusion Model for Video Inpainting
por: Li, Xiaowen, et al.
Publicado: (2025)
por: Li, Xiaowen, et al.
Publicado: (2025)
PerformRecast: Expression and Head Pose Disentanglement for Portrait Video Editing
por: Liang, Jiadong, et al.
Publicado: (2026)
por: Liang, Jiadong, et al.
Publicado: (2026)
Lux Post Facto: Learning Portrait Performance Relighting with Conditional Video Diffusion and a Hybrid Dataset
por: Mei, Yiqun, et al.
Publicado: (2025)
por: Mei, Yiqun, et al.
Publicado: (2025)
Ejemplares similares
-
EMO2: End-Effector Guided Audio-Driven Avatar Video Generation
por: Tian, Linrui, et al.
Publicado: (2025) -
ChatAnyone: Stylized Real-time Portrait Video Generation with Hierarchical Motion Diffusion Model
por: Qi, Jinwei, et al.
Publicado: (2025) -
Controllable and Expressive One-Shot Video Head Swapping
por: Ji, Chaonan, et al.
Publicado: (2025) -
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
por: Fei, Zhengcong, et al.
Publicado: (2025) -
CartoonAlive: Towards Expressive Live2D Modeling from Single Portraits
por: He, Chao, et al.
Publicado: (2025)