Livatar-1: Real-Time Talking Heads Generation with Tailored Flow Matching
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Haiyang, Hong, Xiaolin, Yang, Xuancheng, Ruan, Yudi, Lian, Xiang, Lingelbach, Michael, Yi, Hongwei, Li, Wei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MagicInfinite: Generating Infinite Talking Videos with Your Words and Voice
por: Yi, Hongwei, et al.
Publicado: (2025)
por: Yi, Hongwei, et al.
Publicado: (2025)
DyStream: Streaming Dyadic Talking Heads Generation via Flow Matching-based Autoregressive Model
por: Chen, Bohong, et al.
Publicado: (2025)
por: Chen, Bohong, et al.
Publicado: (2025)
Real-time One-Step Diffusion-based Expressive Portrait Videos Generation
por: Guo, Hanzhong, et al.
Publicado: (2024)
por: Guo, Hanzhong, et al.
Publicado: (2024)
RSATalker: Realistic Socially-Aware Talking Head Generation for Multi-Turn Conversation
por: Chen, Peng, et al.
Publicado: (2026)
por: Chen, Peng, et al.
Publicado: (2026)
DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
por: Ma, Yifeng, et al.
Publicado: (2023)
por: Ma, Yifeng, et al.
Publicado: (2023)
Human-Aware 3D Scene Generation with Spatially-constrained Diffusion Models
por: Hong, Xiaolin, et al.
Publicado: (2024)
por: Hong, Xiaolin, et al.
Publicado: (2024)
SoulX-FlashHead: Oracle-guided Generation of Infinite Real-time Streaming Talking Heads
por: Yu, Tan, et al.
Publicado: (2026)
por: Yu, Tan, et al.
Publicado: (2026)
Learning Online Scale Transformation for Talking Head Video Generation
por: Hong, Fa-Ting, et al.
Publicado: (2024)
por: Hong, Fa-Ting, et al.
Publicado: (2024)
EmoDiffTalk:Emotion-aware Diffusion for Editable 3D Gaussian Talking Head
por: Liu, Chang, et al.
Publicado: (2025)
por: Liu, Chang, et al.
Publicado: (2025)
GaussianTalker: Real-Time High-Fidelity Talking Head Synthesis with Audio-Driven 3D Gaussian Splatting
por: Cho, Kyusun, et al.
Publicado: (2024)
por: Cho, Kyusun, et al.
Publicado: (2024)
OT-Talk: Animating 3D Talking Head with Optimal Transportation
por: Wang, Xinmu, et al.
Publicado: (2025)
por: Wang, Xinmu, et al.
Publicado: (2025)
TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles
por: Ma, Yifeng, et al.
Publicado: (2023)
por: Ma, Yifeng, et al.
Publicado: (2023)
MagicDistillation: Weak-to-Strong Video Distillation for Large-Scale Few-Step Synthesis
por: Shao, Shitong, et al.
Publicado: (2025)
por: Shao, Shitong, et al.
Publicado: (2025)
Jump Cut Smoothing for Talking Heads
por: Wang, Xiaojuan, et al.
Publicado: (2024)
por: Wang, Xiaojuan, et al.
Publicado: (2024)
Magic 1-For-1: Generating One Minute Video Clips within One Minute
por: Yi, Hongwei, et al.
Publicado: (2025)
por: Yi, Hongwei, et al.
Publicado: (2025)
Synergizing Motion and Appearance: Multi-Scale Compensatory Codebooks for Talking Head Video Generation
por: Zhao, Shuling, et al.
Publicado: (2024)
por: Zhao, Shuling, et al.
Publicado: (2024)
UniAvatar: Taming Lifelike Audio-Driven Talking Head Generation with Comprehensive Motion and Lighting Control
por: Sun, Wenzhang, et al.
Publicado: (2024)
por: Sun, Wenzhang, et al.
Publicado: (2024)
Splat-Portrait: Generalizing Talking Heads with Gaussian Splatting
por: Shi, Tong, et al.
Publicado: (2026)
por: Shi, Tong, et al.
Publicado: (2026)
THEval. Evaluation Framework for Talking Head Video Generation
por: Quignon, Nabyl, et al.
Publicado: (2025)
por: Quignon, Nabyl, et al.
Publicado: (2025)
SafeRoPE: Risk-specific Head-wise Embedding Rotation for Safe Generation in Rectified Flow Transformers
por: Yang, Xiang, et al.
Publicado: (2026)
por: Yang, Xiang, et al.
Publicado: (2026)
SyncTalk: The Devil is in the Synchronization for Talking Head Synthesis
por: Peng, Ziqiao, et al.
Publicado: (2023)
por: Peng, Ziqiao, et al.
Publicado: (2023)
VASA-1: Lifelike Audio-Driven Talking Faces Generated in Real Time
por: Xu, Sicheng, et al.
Publicado: (2024)
por: Xu, Sicheng, et al.
Publicado: (2024)
Dual Audio-Centric Modality Coupling for Talking Head Generation
por: Fu, Ao, et al.
Publicado: (2025)
por: Fu, Ao, et al.
Publicado: (2025)
FD2Talk: Towards Generalized Talking Head Generation with Facial Decoupled Diffusion Model
por: Yao, Ziyu, et al.
Publicado: (2024)
por: Yao, Ziyu, et al.
Publicado: (2024)
FixTalk: Taming Identity Leakage for High-Quality Talking Head Generation in Extreme Cases
por: Tan, Shuai, et al.
Publicado: (2025)
por: Tan, Shuai, et al.
Publicado: (2025)
ConsistTalk: Intensity Controllable Temporally Consistent Talking Head Generation with Diffusion Noise Search
por: Liu, Zhenjie, et al.
Publicado: (2025)
por: Liu, Zhenjie, et al.
Publicado: (2025)
MoCoTalk: Multi-Conditional Diffusion with Adaptive Router for Controllable Talking Head Generation
por: Ye, Xinyan, et al.
Publicado: (2026)
por: Ye, Xinyan, et al.
Publicado: (2026)
SyncAnimation: A Real-Time End-to-End Framework for Audio-Driven Human Pose and Talking Head Animation
por: Liu, Yujian, et al.
Publicado: (2025)
por: Liu, Yujian, et al.
Publicado: (2025)
AD-Reasoning: Multimodal Guideline-Guided Reasoning for Alzheimer's Disease Diagnosis
por: Chen, Qiuhui, et al.
Publicado: (2026)
por: Chen, Qiuhui, et al.
Publicado: (2026)
Enhancing 3D Medical Image Understanding with Pretraining Aided by 2D Multimodal Large Language Models
por: Chen, Qiuhui, et al.
Publicado: (2025)
por: Chen, Qiuhui, et al.
Publicado: (2025)
RTGen: Real-Time Generative Detection Transformer
por: Ruan, Chi, et al.
Publicado: (2025)
por: Ruan, Chi, et al.
Publicado: (2025)
Talking Head Generation via AU-Guided Landmark Prediction
por: Chang, Shao-Yu, et al.
Publicado: (2025)
por: Chang, Shao-Yu, et al.
Publicado: (2025)
TalkVid: A Large-Scale Diversified Dataset for Audio-Driven Talking Head Synthesis
por: Chen, Shunian, et al.
Publicado: (2025)
por: Chen, Shunian, et al.
Publicado: (2025)
TalkingHeadBench: A Multi-Modal Benchmark & Analysis of Talking-Head DeepFake Detection
por: Xiong, Xinqi, et al.
Publicado: (2025)
por: Xiong, Xinqi, et al.
Publicado: (2025)
GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
por: Agarwal, Madhav, et al.
Publicado: (2025)
por: Agarwal, Madhav, et al.
Publicado: (2025)
IF-MDM: Implicit Face Motion Diffusion Model for High-Fidelity Realtime Talking Head Generation
por: Yang, Sejong, et al.
Publicado: (2024)
por: Yang, Sejong, et al.
Publicado: (2024)
Real-Time Generation of Streamable Talking Portrait Video with Reference-Guided Deep Compression VAEs
por: Xu, Sicheng, et al.
Publicado: (2026)
por: Xu, Sicheng, et al.
Publicado: (2026)
EmoTalkingGaussian: Continuous Emotion-conditioned Talking Head Synthesis
por: Cha, Junuk, et al.
Publicado: (2025)
por: Cha, Junuk, et al.
Publicado: (2025)
FreeTalk: Emotional Topology-Free 3D Talking Heads
por: Nocentini, Federico, et al.
Publicado: (2026)
por: Nocentini, Federico, et al.
Publicado: (2026)
ScanTalk: 3D Talking Heads from Unregistered Scans
por: Nocentini, Federico, et al.
Publicado: (2024)
por: Nocentini, Federico, et al.
Publicado: (2024)
Ejemplares similares
-
MagicInfinite: Generating Infinite Talking Videos with Your Words and Voice
por: Yi, Hongwei, et al.
Publicado: (2025) -
DyStream: Streaming Dyadic Talking Heads Generation via Flow Matching-based Autoregressive Model
por: Chen, Bohong, et al.
Publicado: (2025) -
Real-time One-Step Diffusion-based Expressive Portrait Videos Generation
por: Guo, Hanzhong, et al.
Publicado: (2024) -
RSATalker: Realistic Socially-Aware Talking Head Generation for Multi-Turn Conversation
por: Chen, Peng, et al.
Publicado: (2026) -
DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
por: Ma, Yifeng, et al.
Publicado: (2023)