GaussianTalker: Speaker-specific Talking Head Synthesis via 3D Gaussian Splatting
Fuente:
arXiv
Salvato in:
| Autori principali: | Yu, Hongyun, Qu, Zhan, Yu, Qihang, Chen, Jianchuan, Jiang, Zhonghua, Chen, Zhiwen, Zhang, Shengyu, Xu, Jimin, Wu, Fei, Lv, Chengfei, Yu, Gang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GaussianTalker: Real-Time High-Fidelity Talking Head Synthesis with Audio-Driven 3D Gaussian Splatting
di: Cho, Kyusun, et al.
Pubblicazione: (2024)
di: Cho, Kyusun, et al.
Pubblicazione: (2024)
PointTalk: Audio-Driven Dynamic Lip Point Cloud for 3D Gaussian-based Talking Head Synthesis
di: Xie, Yifan, et al.
Pubblicazione: (2024)
di: Xie, Yifan, et al.
Pubblicazione: (2024)
TaoAvatar: Real-Time Lifelike Full-Body Talking Avatars for Augmented Reality via 3D Gaussian Splatting
di: Chen, Jianchuan, et al.
Pubblicazione: (2025)
di: Chen, Jianchuan, et al.
Pubblicazione: (2025)
DAE-Talker: High Fidelity Speech-Driven Talking Face Generation with Diffusion Autoencoder
di: Du, Chenpeng, et al.
Pubblicazione: (2023)
di: Du, Chenpeng, et al.
Pubblicazione: (2023)
PureKV: Plug-and-Play KV Cache Optimization with Spatial-Temporal Sparse Attention for Vision-Language Large Models
di: Jiang, Zhonghua, et al.
Pubblicazione: (2025)
di: Jiang, Zhonghua, et al.
Pubblicazione: (2025)
DreamHead: Learning Spatial-Temporal Correspondence via Hierarchical Diffusion for Audio-driven Talking Head Synthesis
di: Hong, Fa-Ting, et al.
Pubblicazione: (2024)
di: Hong, Fa-Ting, et al.
Pubblicazione: (2024)
AccKV: Towards Efficient Audio-Video LLMs Inference via Adaptive-Focusing and Cross-Calibration KV Cache Optimization
di: Jiang, Zhonghua, et al.
Pubblicazione: (2025)
di: Jiang, Zhonghua, et al.
Pubblicazione: (2025)
SegTalker: Segmentation-based Talking Face Generation with Mask-guided Local Editing
di: Xiong, Lingyu, et al.
Pubblicazione: (2024)
di: Xiong, Lingyu, et al.
Pubblicazione: (2024)
GSCodec Studio: A Modular Framework for Gaussian Splat Compression
di: Li, Sicheng, et al.
Pubblicazione: (2025)
di: Li, Sicheng, et al.
Pubblicazione: (2025)
Structured Image-based Coding for Efficient Gaussian Splatting Compression
di: Martin, Pedro, et al.
Pubblicazione: (2026)
di: Martin, Pedro, et al.
Pubblicazione: (2026)
Efficient Geometry Compression and Communication for 3D Gaussian Splatting Point Clouds
di: Xie, Liang, et al.
Pubblicazione: (2025)
di: Xie, Liang, et al.
Pubblicazione: (2025)
Voxel-GS: Quantized Scaffold Gaussian Splatting Compression with Run-Length Coding
di: Fu, Chunyang, et al.
Pubblicazione: (2025)
di: Fu, Chunyang, et al.
Pubblicazione: (2025)
A Survey on 3D Gaussian Splatting
di: Chen, Guikun, et al.
Pubblicazione: (2024)
di: Chen, Guikun, et al.
Pubblicazione: (2024)
GS-QA: Comprehensive Quality Assessment Benchmark for Gaussian Splatting View Synthesis
di: Martin, Pedro, et al.
Pubblicazione: (2025)
di: Martin, Pedro, et al.
Pubblicazione: (2025)
OpFlowTalker: Realistic and Natural Talking Face Generation via Optical Flow Guidance
di: Ge, Shuheng, et al.
Pubblicazione: (2024)
di: Ge, Shuheng, et al.
Pubblicazione: (2024)
PRoGS: Progressive Rendering of Gaussian Splats
di: Zoomers, Brent, et al.
Pubblicazione: (2024)
di: Zoomers, Brent, et al.
Pubblicazione: (2024)
GaussianForest: Hierarchical-Hybrid 3D Gaussian Splatting for Compressed Scene Modeling
di: Zhang, Fengyi, et al.
Pubblicazione: (2024)
di: Zhang, Fengyi, et al.
Pubblicazione: (2024)
EARTalking: End-to-end GPT-style Autoregressive Talking Head Synthesis with Frame-wise Control
di: Weng, Yuzhe, et al.
Pubblicazione: (2026)
di: Weng, Yuzhe, et al.
Pubblicazione: (2026)
Dual-Stream Decoupled Learning for Temporal Consistency and Speaker Interaction in AVSD
di: Xiao, Junhao, et al.
Pubblicazione: (2025)
di: Xiao, Junhao, et al.
Pubblicazione: (2025)
L3GS: Layered 3D Gaussian Splats for Efficient 3D Scene Delivery
di: Tsai, Yi-Zhen, et al.
Pubblicazione: (2025)
di: Tsai, Yi-Zhen, et al.
Pubblicazione: (2025)
Adaptive 3D Gaussian Splatting Video Streaming
di: Gong, Han, et al.
Pubblicazione: (2025)
di: Gong, Han, et al.
Pubblicazione: (2025)
REArtGS: Reconstructing and Generating Articulated Objects via 3D Gaussian Splatting with Geometric and Motion Constraints
di: Wu, Di, et al.
Pubblicazione: (2025)
di: Wu, Di, et al.
Pubblicazione: (2025)
Automated Radiology Report Generation Based on Topic-Keyword Semantic Guidance
di: Xiao, Jing, et al.
Pubblicazione: (2025)
di: Xiao, Jing, et al.
Pubblicazione: (2025)
Test-Time Self-Adaptive Conditioning for Stable Audio-Driven Talking-Head Generation
di: Zhang, Zhicheng, et al.
Pubblicazione: (2026)
di: Zhang, Zhicheng, et al.
Pubblicazione: (2026)
GGAvatar: Reconstructing Garment-Separated 3D Gaussian Splatting Avatars from Monocular Video
di: Chen, Jingxuan
Pubblicazione: (2024)
di: Chen, Jingxuan
Pubblicazione: (2024)
SVGS: Enhancing Gaussian Splatting Using Primitives with Spatially Varying Colors
di: Xu, Rui, et al.
Pubblicazione: (2024)
di: Xu, Rui, et al.
Pubblicazione: (2024)
GScomp-QA: A Subjective Dataset for Quality Assessment of Compressed Gaussian Splatting
di: Martin, Pedro, et al.
Pubblicazione: (2026)
di: Martin, Pedro, et al.
Pubblicazione: (2026)
Region-Adaptive Learned Hierarchical Encoding for 3D Gaussian Splatting Data
di: Sridhara, Shashank N., et al.
Pubblicazione: (2025)
di: Sridhara, Shashank N., et al.
Pubblicazione: (2025)
MTAVG-Bench: A Diagnostic Benchmark for Multi-Talker Dialogue-Centric Audio-Video Generation
di: Zhou, Yang-Hao, et al.
Pubblicazione: (2026)
di: Zhou, Yang-Hao, et al.
Pubblicazione: (2026)
MTAVG-Bench 2.0: Diagnosing Failure Modes of Cinematic Expressiveness in Multi-Talker Audio-Video Generation
di: Li, Haitian, et al.
Pubblicazione: (2026)
di: Li, Haitian, et al.
Pubblicazione: (2026)
GTLR-GS: Geometry-Texture Aware LiDAR-Regularized 3D Gaussian Splatting for Realistic Scene Reconstruction
di: Fang, Yan, et al.
Pubblicazione: (2026)
di: Fang, Yan, et al.
Pubblicazione: (2026)
A Hierarchical Compression Technique for 3D Gaussian Splatting Compression
di: Huang, He, et al.
Pubblicazione: (2024)
di: Huang, He, et al.
Pubblicazione: (2024)
Controllable Text-to-Speech Synthesis with Masked-Autoencoded Style-Rich Representation
di: Wang, Yongqi, et al.
Pubblicazione: (2025)
di: Wang, Yongqi, et al.
Pubblicazione: (2025)
SAGE: Semantic-Driven Adaptive Gaussian Splatting in Extended Reality
di: Schiavo, Chiara, et al.
Pubblicazione: (2025)
di: Schiavo, Chiara, et al.
Pubblicazione: (2025)
SizeGS: Size-aware Compression of 3D Gaussian Splatting via Mixed Integer Programming
di: Xie, Shuzhao, et al.
Pubblicazione: (2024)
di: Xie, Shuzhao, et al.
Pubblicazione: (2024)
FD2Talk: Towards Generalized Talking Head Generation with Facial Decoupled Diffusion Model
di: Yao, Ziyu, et al.
Pubblicazione: (2024)
di: Yao, Ziyu, et al.
Pubblicazione: (2024)
MesonGS++: Post-training Compression of 3D Gaussian Splatting with Hyperparameter Searching
di: Xie, Shuzhao, et al.
Pubblicazione: (2026)
di: Xie, Shuzhao, et al.
Pubblicazione: (2026)
GSVC: Efficient Video Representation and Compression Through 2D Gaussian Splatting
di: Wang, Longan, et al.
Pubblicazione: (2025)
di: Wang, Longan, et al.
Pubblicazione: (2025)
LapisGS: Layered Progressive 3D Gaussian Splatting for Adaptive Streaming
di: Shi, Yuang, et al.
Pubblicazione: (2024)
di: Shi, Yuang, et al.
Pubblicazione: (2024)
D-FCGS: Feedforward Compression of Dynamic Gaussian Splatting for Free-Viewpoint Videos
di: Zhang, Wenkang, et al.
Pubblicazione: (2025)
di: Zhang, Wenkang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
GaussianTalker: Real-Time High-Fidelity Talking Head Synthesis with Audio-Driven 3D Gaussian Splatting
di: Cho, Kyusun, et al.
Pubblicazione: (2024) -
PointTalk: Audio-Driven Dynamic Lip Point Cloud for 3D Gaussian-based Talking Head Synthesis
di: Xie, Yifan, et al.
Pubblicazione: (2024) -
TaoAvatar: Real-Time Lifelike Full-Body Talking Avatars for Augmented Reality via 3D Gaussian Splatting
di: Chen, Jianchuan, et al.
Pubblicazione: (2025) -
DAE-Talker: High Fidelity Speech-Driven Talking Face Generation with Diffusion Autoencoder
di: Du, Chenpeng, et al.
Pubblicazione: (2023) -
PureKV: Plug-and-Play KV Cache Optimization with Spatial-Temporal Sparse Attention for Vision-Language Large Models
di: Jiang, Zhonghua, et al.
Pubblicazione: (2025)