GMTalker: Gaussian Mixture-based Audio-Driven Emotional Talking Video Portraits
Fuente:
arXiv
Guardado en:
| Autores principales: | Xia, Yibo, Wang, Lizhen, Deng, Xiang, Luo, Xiaoyan, Wang, Yunhong, Liu, Yebin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MoEE: Mixture of Emotion Experts for Audio-Driven Portrait Animation
por: Liu, Huaize, et al.
Publicado: (2025)
por: Liu, Huaize, et al.
Publicado: (2025)
Stereo-Talker: Audio-driven 3D Human Synthesis with Prior-Guided Mixture-of-Experts
por: Deng, Xiang, et al.
Publicado: (2024)
por: Deng, Xiang, et al.
Publicado: (2024)
UniTalking: A Unified Audio-Video Framework for Talking Portrait Generation
por: Li, Hebeizi, et al.
Publicado: (2026)
por: Li, Hebeizi, et al.
Publicado: (2026)
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
por: Fei, Zhengcong, et al.
Publicado: (2025)
por: Fei, Zhengcong, et al.
Publicado: (2025)
FantasyTalking2: Timestep-Layer Adaptive Preference Optimization for Audio-Driven Portrait Animation
por: Wang, MengChao, et al.
Publicado: (2025)
por: Wang, MengChao, et al.
Publicado: (2025)
EmotiveTalk: Expressive Talking Head Generation through Audio Information Decoupling and Emotional Video Diffusion
por: Wang, Haotian, et al.
Publicado: (2024)
por: Wang, Haotian, et al.
Publicado: (2024)
Disentangle Identity, Cooperate Emotion: Correlation-Aware Emotional Talking Portrait Generation
por: Tan, Weipeng, et al.
Publicado: (2025)
por: Tan, Weipeng, et al.
Publicado: (2025)
FlowPortrait: Reinforcement Learning for Audio-Driven Portrait Video Generation
por: Tan, Weiting, et al.
Publicado: (2026)
por: Tan, Weiting, et al.
Publicado: (2026)
Splat-Portrait: Generalizing Talking Heads with Gaussian Splatting
por: Shi, Tong, et al.
Publicado: (2026)
por: Shi, Tong, et al.
Publicado: (2026)
DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
por: Ma, Yifeng, et al.
Publicado: (2023)
por: Ma, Yifeng, et al.
Publicado: (2023)
GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
por: Agarwal, Madhav, et al.
Publicado: (2025)
por: Agarwal, Madhav, et al.
Publicado: (2025)
Real-Time Generation of Streamable Talking Portrait Video with Reference-Guided Deep Compression VAEs
por: Xu, Sicheng, et al.
Publicado: (2026)
por: Xu, Sicheng, et al.
Publicado: (2026)
Animatable and Relightable Gaussians for High-fidelity Human Avatar Modeling
por: Li, Zhe, et al.
Publicado: (2023)
por: Li, Zhe, et al.
Publicado: (2023)
EmoCAST: Emotional Talking Portrait via Emotive Text Description
por: Jiang, Yiguo, et al.
Publicado: (2025)
por: Jiang, Yiguo, et al.
Publicado: (2025)
Let Them Talk: Audio-Driven Multi-Person Conversational Video Generation
por: Kong, Zhe, et al.
Publicado: (2025)
por: Kong, Zhe, et al.
Publicado: (2025)
AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation
por: Wei, Huawei, et al.
Publicado: (2024)
por: Wei, Huawei, et al.
Publicado: (2024)
EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions
por: Tian, Linrui, et al.
Publicado: (2024)
por: Tian, Linrui, et al.
Publicado: (2024)
FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis
por: Wang, Mengchao, et al.
Publicado: (2025)
por: Wang, Mengchao, et al.
Publicado: (2025)
Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation
por: Xu, Mingwang, et al.
Publicado: (2024)
por: Xu, Mingwang, et al.
Publicado: (2024)
X-Actor: Emotional and Expressive Long-Range Portrait Acting from Audio
por: Zhang, Chenxu, et al.
Publicado: (2025)
por: Zhang, Chenxu, et al.
Publicado: (2025)
Stable Video-Driven Portraits
por: R., Mallikarjun B., et al.
Publicado: (2025)
por: R., Mallikarjun B., et al.
Publicado: (2025)
EvalTalker: Learning to Evaluate Real-Portrait-Driven Multi-Subject Talking Humans
por: Zhou, Yingjie, et al.
Publicado: (2025)
por: Zhou, Yingjie, et al.
Publicado: (2025)
PortraitTalk: Towards Customizable One-Shot Audio-to-Talking Face Generation
por: Nazarieh, Fatemeh, et al.
Publicado: (2024)
por: Nazarieh, Fatemeh, et al.
Publicado: (2024)
JoyGen: Audio-Driven 3D Depth-Aware Talking-Face Video Editing
por: Wang, Qili, et al.
Publicado: (2025)
por: Wang, Qili, et al.
Publicado: (2025)
Unlock Pose Diversity: Accurate and Efficient Implicit Keypoint-based Spatiotemporal Diffusion for Audio-driven Talking Portrait
por: Yang, Chaolong, et al.
Publicado: (2025)
por: Yang, Chaolong, et al.
Publicado: (2025)
Real3D-Portrait: One-shot Realistic 3D Talking Portrait Synthesis
por: Ye, Zhenhui, et al.
Publicado: (2024)
por: Ye, Zhenhui, et al.
Publicado: (2024)
TalkVid: A Large-Scale Diversified Dataset for Audio-Driven Talking Head Synthesis
por: Chen, Shunian, et al.
Publicado: (2025)
por: Chen, Shunian, et al.
Publicado: (2025)
TalkVerse: Democratizing Minute-Long Audio-Driven Video Generation
por: Wang, Zhenzhi, et al.
Publicado: (2025)
por: Wang, Zhenzhi, et al.
Publicado: (2025)
LLIA -- Enabling Low-Latency Interactive Avatars: Real-Time Audio-Driven Portrait Video Generation with Diffusion Models
por: Yu, Haojie, et al.
Publicado: (2025)
por: Yu, Haojie, et al.
Publicado: (2025)
InvertAvatar: Incremental GAN Inversion for Generalized Head Avatars
por: Zhao, Xiaochen, et al.
Publicado: (2023)
por: Zhao, Xiaochen, et al.
Publicado: (2023)
FREAK: Frequency-modulated High-fidelity and Real-time Audio-driven Talking Portrait Synthesis
por: Ni, Ziqi, et al.
Publicado: (2025)
por: Ni, Ziqi, et al.
Publicado: (2025)
InfiniteTalk: Audio-driven Video Generation for Sparse-Frame Video Dubbing
por: Yang, Shaoshu, et al.
Publicado: (2025)
por: Yang, Shaoshu, et al.
Publicado: (2025)
EmoTalkingGaussian: Continuous Emotion-conditioned Talking Head Synthesis
por: Cha, Junuk, et al.
Publicado: (2025)
por: Cha, Junuk, et al.
Publicado: (2025)
SPMTrack: Spatio-Temporal Parameter-Efficient Fine-Tuning with Mixture of Experts for Scalable Visual Tracking
por: Cai, Wenrui, et al.
Publicado: (2025)
por: Cai, Wenrui, et al.
Publicado: (2025)
OmniTalker: One-shot Real-time Text-Driven Talking Audio-Video Generation With Multimodal Style Mimicking
por: Wang, Zhongjian, et al.
Publicado: (2025)
por: Wang, Zhongjian, et al.
Publicado: (2025)
GSTalker: Real-time Audio-Driven Talking Face Generation via Deformable Gaussian Splatting
por: Chen, Bo, et al.
Publicado: (2024)
por: Chen, Bo, et al.
Publicado: (2024)
EmoGene: Audio-Driven Emotional 3D Talking-Head Generation
por: Wang, Wenqing, et al.
Publicado: (2024)
por: Wang, Wenqing, et al.
Publicado: (2024)
EmoDiffTalk:Emotion-aware Diffusion for Editable 3D Gaussian Talking Head
por: Liu, Chang, et al.
Publicado: (2025)
por: Liu, Chang, et al.
Publicado: (2025)
Audio-Driven Talking Face Video Generation with Joint Uncertainty Learning
por: Xie, Yifan, et al.
Publicado: (2025)
por: Xie, Yifan, et al.
Publicado: (2025)
Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation
por: Cui, Jiahao, et al.
Publicado: (2024)
por: Cui, Jiahao, et al.
Publicado: (2024)
Ejemplares similares
-
MoEE: Mixture of Emotion Experts for Audio-Driven Portrait Animation
por: Liu, Huaize, et al.
Publicado: (2025) -
Stereo-Talker: Audio-driven 3D Human Synthesis with Prior-Guided Mixture-of-Experts
por: Deng, Xiang, et al.
Publicado: (2024) -
UniTalking: A Unified Audio-Video Framework for Talking Portrait Generation
por: Li, Hebeizi, et al.
Publicado: (2026) -
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
por: Fei, Zhengcong, et al.
Publicado: (2025) -
FantasyTalking2: Timestep-Layer Adaptive Preference Optimization for Audio-Driven Portrait Animation
por: Wang, MengChao, et al.
Publicado: (2025)