GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
Fuente:
arXiv
Guardado en:
| Autores principales: | Agarwal, Madhav, Zhang, Mingtian, Sevilla-Lara, Laura, McDonagh, Steven |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TalkingGaussian: Structure-Persistent 3D Talking Head Synthesis via Gaussian Splatting
por: Li, Jiahe, et al.
Publicado: (2024)
por: Li, Jiahe, et al.
Publicado: (2024)
Splat-Portrait: Generalizing Talking Heads with Gaussian Splatting
por: Shi, Tong, et al.
Publicado: (2026)
por: Shi, Tong, et al.
Publicado: (2026)
GaussianTalker: Real-Time High-Fidelity Talking Head Synthesis with Audio-Driven 3D Gaussian Splatting
por: Cho, Kyusun, et al.
Publicado: (2024)
por: Cho, Kyusun, et al.
Publicado: (2024)
Why Do Vision Language Models Struggle To Recognize Human Emotions?
por: Agarwal, Madhav, et al.
Publicado: (2026)
por: Agarwal, Madhav, et al.
Publicado: (2026)
GaussianTalker: Speaker-specific Talking Head Synthesis via 3D Gaussian Splatting
por: Yu, Hongyun, et al.
Publicado: (2024)
por: Yu, Hongyun, et al.
Publicado: (2024)
GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting
por: Agarwal, Anushka, et al.
Publicado: (2025)
por: Agarwal, Anushka, et al.
Publicado: (2025)
EmbedTalk: Triplane-Free Talking Head Synthesis using Embedding-Driven Gaussian Deformation
por: Saggar, Arpita, et al.
Publicado: (2026)
por: Saggar, Arpita, et al.
Publicado: (2026)
SyncTalk++: High-Fidelity and Efficient Synchronized Talking Heads Synthesis Using Gaussian Splatting
por: Peng, Ziqiao, et al.
Publicado: (2025)
por: Peng, Ziqiao, et al.
Publicado: (2025)
Audio-Plane: Audio Factorization Plane Gaussian Splatting for Real-Time Talking Head Synthesis
por: Shen, Shuai, et al.
Publicado: (2025)
por: Shen, Shuai, et al.
Publicado: (2025)
FreeTalk: Emotional Topology-Free 3D Talking Heads
por: Nocentini, Federico, et al.
Publicado: (2026)
por: Nocentini, Federico, et al.
Publicado: (2026)
EmoDiffTalk:Emotion-aware Diffusion for Editable 3D Gaussian Talking Head
por: Liu, Chang, et al.
Publicado: (2025)
por: Liu, Chang, et al.
Publicado: (2025)
EmoTalkingGaussian: Continuous Emotion-conditioned Talking Head Synthesis
por: Cha, Junuk, et al.
Publicado: (2025)
por: Cha, Junuk, et al.
Publicado: (2025)
Monocular and Generalizable Gaussian Talking Head Animation
por: Gong, Shengjie, et al.
Publicado: (2025)
por: Gong, Shengjie, et al.
Publicado: (2025)
SplatTalk: 3D VQA with Gaussian Splatting
por: Thai, Anh, et al.
Publicado: (2025)
por: Thai, Anh, et al.
Publicado: (2025)
TalkVid: A Large-Scale Diversified Dataset for Audio-Driven Talking Head Synthesis
por: Chen, Shunian, et al.
Publicado: (2025)
por: Chen, Shunian, et al.
Publicado: (2025)
EmoTalk3D: High-Fidelity Free-View Synthesis of Emotional 3D Talking Head
por: He, Qianyun, et al.
Publicado: (2024)
por: He, Qianyun, et al.
Publicado: (2024)
EmoTaG: Emotion-Aware Talking Head Synthesis on Gaussian Splatting with Few-Shot Personalization
por: Xu, Haolan, et al.
Publicado: (2026)
por: Xu, Haolan, et al.
Publicado: (2026)
ScanTalk: 3D Talking Heads from Unregistered Scans
por: Nocentini, Federico, et al.
Publicado: (2024)
por: Nocentini, Federico, et al.
Publicado: (2024)
Supervising 3D Talking Head Avatars with Analysis-by-Audio-Synthesis
por: Daněček, Radek, et al.
Publicado: (2025)
por: Daněček, Radek, et al.
Publicado: (2025)
Few-Shot Identity Adaptation for 3D Talking Heads via Global Gaussian Field
por: Nie, Hong, et al.
Publicado: (2025)
por: Nie, Hong, et al.
Publicado: (2025)
GGTalker: Talking Head Systhesis with Generalizable Gaussian Priors and Identity-Specific Adaptation
por: Hu, Wentao, et al.
Publicado: (2025)
por: Hu, Wentao, et al.
Publicado: (2025)
GSTalker: Real-time Audio-Driven Talking Face Generation via Deformable Gaussian Splatting
por: Chen, Bo, et al.
Publicado: (2024)
por: Chen, Bo, et al.
Publicado: (2024)
OT-Talk: Animating 3D Talking Head with Optimal Transportation
por: Wang, Xinmu, et al.
Publicado: (2025)
por: Wang, Xinmu, et al.
Publicado: (2025)
EmoVOCA: Speech-Driven Emotional 3D Talking Heads
por: Nocentini, Federico, et al.
Publicado: (2024)
por: Nocentini, Federico, et al.
Publicado: (2024)
SyncTalk: The Devil is in the Synchronization for Talking Head Synthesis
por: Peng, Ziqiao, et al.
Publicado: (2023)
por: Peng, Ziqiao, et al.
Publicado: (2023)
JambaTalk: Speech-Driven 3D Talking Head Generation Based on Hybrid Transformer-Mamba Model
por: Jafari, Farzaneh, et al.
Publicado: (2024)
por: Jafari, Farzaneh, et al.
Publicado: (2024)
Audio-Driven Universal Gaussian Head Avatars
por: Teotia, Kartik, et al.
Publicado: (2025)
por: Teotia, Kartik, et al.
Publicado: (2025)
HeadStudio: Text to Animatable Head Avatars with 3D Gaussian Splatting
por: Zhou, Zhenglin, et al.
Publicado: (2024)
por: Zhou, Zhenglin, et al.
Publicado: (2024)
Audio-Visual Driven Compression for Low-Bitrate Talking Head Videos
por: Takahashi, Riku, et al.
Publicado: (2025)
por: Takahashi, Riku, et al.
Publicado: (2025)
EmoGene: Audio-Driven Emotional 3D Talking-Head Generation
por: Wang, Wenqing, et al.
Publicado: (2024)
por: Wang, Wenqing, et al.
Publicado: (2024)
SyncBreaker:Stage-Aware Multimodal Adversarial Attacks on Audio-Driven Talking Head Generation
por: Zhang, Wenli, et al.
Publicado: (2026)
por: Zhang, Wenli, et al.
Publicado: (2026)
Exploiting Temporal Audio-Visual Correlation Embedding for Audio-Driven One-Shot Talking Head Animation
por: Xu, Zhihua, et al.
Publicado: (2025)
por: Xu, Zhihua, et al.
Publicado: (2025)
Jump Cut Smoothing for Talking Heads
por: Wang, Xiaojuan, et al.
Publicado: (2024)
por: Wang, Xiaojuan, et al.
Publicado: (2024)
Test-Time Self-Adaptive Conditioning for Stable Audio-Driven Talking-Head Generation
por: Zhang, Zhicheng, et al.
Publicado: (2026)
por: Zhang, Zhicheng, et al.
Publicado: (2026)
Dimitra: Audio-driven Diffusion model for Expressive Talking Head Generation
por: Chopin, Baptiste, et al.
Publicado: (2025)
por: Chopin, Baptiste, et al.
Publicado: (2025)
TalkingHeadBench: A Multi-Modal Benchmark & Analysis of Talking-Head DeepFake Detection
por: Xiong, Xinqi, et al.
Publicado: (2025)
por: Xiong, Xinqi, et al.
Publicado: (2025)
ATL-Diff: Audio-Driven Talking Head Generation with Early Landmarks-Guide Noise Diffusion
por: Vo, Hoang-Son, et al.
Publicado: (2025)
por: Vo, Hoang-Son, et al.
Publicado: (2025)
CapTalk: Text-Guided Stylization and Speech-Driven 3D Head Animation
por: Chu, Xuangeng, et al.
Publicado: (2026)
por: Chu, Xuangeng, et al.
Publicado: (2026)
UniAvatar: Taming Lifelike Audio-Driven Talking Head Generation with Comprehensive Motion and Lighting Control
por: Sun, Wenzhang, et al.
Publicado: (2024)
por: Sun, Wenzhang, et al.
Publicado: (2024)
GMTalker: Gaussian Mixture-based Audio-Driven Emotional Talking Video Portraits
por: Xia, Yibo, et al.
Publicado: (2023)
por: Xia, Yibo, et al.
Publicado: (2023)
Ejemplares similares
-
TalkingGaussian: Structure-Persistent 3D Talking Head Synthesis via Gaussian Splatting
por: Li, Jiahe, et al.
Publicado: (2024) -
Splat-Portrait: Generalizing Talking Heads with Gaussian Splatting
por: Shi, Tong, et al.
Publicado: (2026) -
GaussianTalker: Real-Time High-Fidelity Talking Head Synthesis with Audio-Driven 3D Gaussian Splatting
por: Cho, Kyusun, et al.
Publicado: (2024) -
Why Do Vision Language Models Struggle To Recognize Human Emotions?
por: Agarwal, Madhav, et al.
Publicado: (2026) -
GaussianTalker: Speaker-specific Talking Head Synthesis via 3D Gaussian Splatting
por: Yu, Hongyun, et al.
Publicado: (2024)