RSATalker: Realistic Socially-Aware Talking Head Generation for Multi-Turn Conversation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Peng, Wei, Xiaobao, Yang, Yi, Yao, Naiming, Chen, Hui, Tian, Feng |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DiffusionTalker: Efficient and Compact Speech-Driven 3D Talking Head via Personalizer-Guided Distillation
par: Chen, Peng, et autres
Publié: (2025)
par: Chen, Peng, et autres
Publié: (2025)
GraphAvatar: Compact Head Avatars with GNN-Generated 3D Gaussians
par: Wei, Xiaobao, et autres
Publié: (2024)
par: Wei, Xiaobao, et autres
Publié: (2024)
MixedGaussianAvatar: Realistically and Geometrically Accurate Head Avatar via Mixed 2D-3D Gaussians
par: Chen, Peng, et autres
Publié: (2024)
par: Chen, Peng, et autres
Publié: (2024)
AUHead: Realistic Emotional Talking Head Generation via Action Units Control
par: Lyu, Jiayi, et autres
Publié: (2026)
par: Lyu, Jiayi, et autres
Publié: (2026)
GazeGaussian: High-Fidelity Gaze Redirection with 3D Gaussian Splatting
par: Wei, Xiaobao, et autres
Publié: (2024)
par: Wei, Xiaobao, et autres
Publié: (2024)
Let Them Talk: Audio-Driven Multi-Person Conversational Video Generation
par: Kong, Zhe, et autres
Publié: (2025)
par: Kong, Zhe, et autres
Publié: (2025)
MoDA: Multi-modal Diffusion Architecture for Talking Head Generation
par: Li, Xinyang, et autres
Publié: (2025)
par: Li, Xinyang, et autres
Publié: (2025)
SyncTalk++: High-Fidelity and Efficient Synchronized Talking Heads Synthesis Using Gaussian Splatting
par: Peng, Ziqiao, et autres
Publié: (2025)
par: Peng, Ziqiao, et autres
Publié: (2025)
FD2Talk: Towards Generalized Talking Head Generation with Facial Decoupled Diffusion Model
par: Yao, Ziyu, et autres
Publié: (2024)
par: Yao, Ziyu, et autres
Publié: (2024)
Talk2Image: A Multi-Agent System for Multi-Turn Image Generation and Editing
par: Ma, Shichao, et autres
Publié: (2025)
par: Ma, Shichao, et autres
Publié: (2025)
Livatar-1: Real-Time Talking Heads Generation with Tailored Flow Matching
par: Liu, Haiyang, et autres
Publié: (2025)
par: Liu, Haiyang, et autres
Publié: (2025)
HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis
par: Liu, Shiyu, et autres
Publié: (2025)
par: Liu, Shiyu, et autres
Publié: (2025)
SyncBreaker:Stage-Aware Multimodal Adversarial Attacks on Audio-Driven Talking Head Generation
par: Zhang, Wenli, et autres
Publié: (2026)
par: Zhang, Wenli, et autres
Publié: (2026)
FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis
par: Wang, Mengchao, et autres
Publié: (2025)
par: Wang, Mengchao, et autres
Publié: (2025)
MoCoTalk: Multi-Conditional Diffusion with Adaptive Router for Controllable Talking Head Generation
par: Ye, Xinyan, et autres
Publié: (2026)
par: Ye, Xinyan, et autres
Publié: (2026)
SyncTalk: The Devil is in the Synchronization for Talking Head Synthesis
par: Peng, Ziqiao, et autres
Publié: (2023)
par: Peng, Ziqiao, et autres
Publié: (2023)
GGTalker: Talking Head Systhesis with Generalizable Gaussian Priors and Identity-Specific Adaptation
par: Hu, Wentao, et autres
Publié: (2025)
par: Hu, Wentao, et autres
Publié: (2025)
TalkingHeadBench: A Multi-Modal Benchmark & Analysis of Talking-Head DeepFake Detection
par: Xiong, Xinqi, et autres
Publié: (2025)
par: Xiong, Xinqi, et autres
Publié: (2025)
Towards Seamless Interaction: Causal Turn-Level Modeling of Interactive 3D Conversational Head Dynamics
par: Chen, Junjie, et autres
Publié: (2025)
par: Chen, Junjie, et autres
Publié: (2025)
TalkVid: A Large-Scale Diversified Dataset for Audio-Driven Talking Head Synthesis
par: Chen, Shunian, et autres
Publié: (2025)
par: Chen, Shunian, et autres
Publié: (2025)
RealTalk: Realistic Emotion-Aware Lifelike Talking-Head Synthesis
par: Wang, Wenqing, et autres
Publié: (2025)
par: Wang, Wenqing, et autres
Publié: (2025)
Monocular and Generalizable Gaussian Talking Head Animation
par: Gong, Shengjie, et autres
Publié: (2025)
par: Gong, Shengjie, et autres
Publié: (2025)
DualTalk: Dual-Speaker Interaction for 3D Talking Head Conversations
par: Peng, Ziqiao, et autres
Publié: (2025)
par: Peng, Ziqiao, et autres
Publié: (2025)
TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles
par: Ma, Yifeng, et autres
Publié: (2023)
par: Ma, Yifeng, et autres
Publié: (2023)
Emotional Conversation: Empowering Talking Faces with Cohesive Expression, Gaze and Pose Generation
par: Liang, Jiadong, et autres
Publié: (2024)
par: Liang, Jiadong, et autres
Publié: (2024)
Jump Cut Smoothing for Talking Heads
par: Wang, Xiaojuan, et autres
Publié: (2024)
par: Wang, Xiaojuan, et autres
Publié: (2024)
Exploiting Temporal Audio-Visual Correlation Embedding for Audio-Driven One-Shot Talking Head Animation
par: Xu, Zhihua, et autres
Publié: (2025)
par: Xu, Zhihua, et autres
Publié: (2025)
MultiTalk: Enhancing 3D Talking Head Generation Across Languages with Multilingual Video Dataset
par: Sung-Bin, Kim, et autres
Publié: (2024)
par: Sung-Bin, Kim, et autres
Publié: (2024)
MANGO:Natural Multi-speaker 3D Talking Head Generation via 2D-Lifted Enhancement
par: Zhu, Lei, et autres
Publié: (2026)
par: Zhu, Lei, et autres
Publié: (2026)
AvatarMakeup: Realistic Makeup Transfer for 3D Animatable Head Avatars
par: Zhong, Yiming, et autres
Publié: (2025)
par: Zhong, Yiming, et autres
Publié: (2025)
Exploring Talking Head Models With Adjacent Frame Prior for Speech-Preserving Facial Expression Manipulation
par: Lu, Zhenxuan, et autres
Publié: (2026)
par: Lu, Zhenxuan, et autres
Publié: (2026)
DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
par: Ma, Yifeng, et autres
Publié: (2023)
par: Ma, Yifeng, et autres
Publié: (2023)
DyStream: Streaming Dyadic Talking Heads Generation via Flow Matching-based Autoregressive Model
par: Chen, Bohong, et autres
Publié: (2025)
par: Chen, Bohong, et autres
Publié: (2025)
Splat-Portrait: Generalizing Talking Heads with Gaussian Splatting
par: Shi, Tong, et autres
Publié: (2026)
par: Shi, Tong, et autres
Publié: (2026)
THEval. Evaluation Framework for Talking Head Video Generation
par: Quignon, Nabyl, et autres
Publié: (2025)
par: Quignon, Nabyl, et autres
Publié: (2025)
Synergizing Motion and Appearance: Multi-Scale Compensatory Codebooks for Talking Head Video Generation
par: Zhao, Shuling, et autres
Publié: (2024)
par: Zhao, Shuling, et autres
Publié: (2024)
UniAvatar: Taming Lifelike Audio-Driven Talking Head Generation with Comprehensive Motion and Lighting Control
par: Sun, Wenzhang, et autres
Publié: (2024)
par: Sun, Wenzhang, et autres
Publié: (2024)
OT-Talk: Animating 3D Talking Head with Optimal Transportation
par: Wang, Xinmu, et autres
Publié: (2025)
par: Wang, Xinmu, et autres
Publié: (2025)
Audio-driven High-resolution Seamless Talking Head Video Editing via StyleGAN
par: Su, Jiacheng, et autres
Publié: (2024)
par: Su, Jiacheng, et autres
Publié: (2024)
FixTalk: Taming Identity Leakage for High-Quality Talking Head Generation in Extreme Cases
par: Tan, Shuai, et autres
Publié: (2025)
par: Tan, Shuai, et autres
Publié: (2025)
Documents similaires
-
DiffusionTalker: Efficient and Compact Speech-Driven 3D Talking Head via Personalizer-Guided Distillation
par: Chen, Peng, et autres
Publié: (2025) -
GraphAvatar: Compact Head Avatars with GNN-Generated 3D Gaussians
par: Wei, Xiaobao, et autres
Publié: (2024) -
MixedGaussianAvatar: Realistically and Geometrically Accurate Head Avatar via Mixed 2D-3D Gaussians
par: Chen, Peng, et autres
Publié: (2024) -
AUHead: Realistic Emotional Talking Head Generation via Action Units Control
par: Lyu, Jiayi, et autres
Publié: (2026) -
GazeGaussian: High-Fidelity Gaze Redirection with 3D Gaussian Splatting
par: Wei, Xiaobao, et autres
Publié: (2024)