Learning Dynamic Tetrahedra for High-Quality Talking Head Synthesis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Zicheng, Zheng, Ruobing, Liu, Ziwen, Han, Congying, Li, Tianqi, Wang, Meng, Guo, Tiande, Chen, Jingdong, Li, Bonan, Yang, Ming |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis
par: Li, Tianqi, et autres
Publié: (2024)
par: Li, Tianqi, et autres
Publié: (2024)
Ditto: Motion-Space Diffusion for Controllable Realtime Talking Head Synthesis
par: Li, Tianqi, et autres
Publié: (2024)
par: Li, Tianqi, et autres
Publié: (2024)
DR-BFR: Degradation Representation with Diffusion Models for Blind Face Restoration
par: Qiu, Xinmin, et autres
Publié: (2024)
par: Qiu, Xinmin, et autres
Publié: (2024)
BlazeBVD: Make Scale-Time Equalization Great Again for Blind Video Deflickering
par: Qiu, Xinmin, et autres
Publié: (2024)
par: Qiu, Xinmin, et autres
Publié: (2024)
StyO: Stylize Your Face in Only One-shot
par: Li, Bonan, et autres
Publié: (2023)
par: Li, Bonan, et autres
Publié: (2023)
Resolving Endpoint Underfitting in Diffusion Bridges via Noise Alignment
par: Gao, Yurong, et autres
Publié: (2026)
par: Gao, Yurong, et autres
Publié: (2026)
Dual Tuning for Reasoning Efficacy-Driven Data Curation in Multimodal LLM Training
par: Zheng, Ruobing, et autres
Publié: (2026)
par: Zheng, Ruobing, et autres
Publié: (2026)
Versatile Multimodal Controls for Expressive Talking Human Animation
par: Qin, Zheng, et autres
Publié: (2025)
par: Qin, Zheng, et autres
Publié: (2025)
HumanSense: From Multimodal Perception to Empathetic Context-Aware Responses through Reasoning MLLMs
par: Qin, Zheng, et autres
Publié: (2025)
par: Qin, Zheng, et autres
Publié: (2025)
THQA: A Perceptual Quality Assessment Database for Talking Heads
par: Zhou, Yingjie, et autres
Publié: (2024)
par: Zhou, Yingjie, et autres
Publié: (2024)
TalkingGaussian: Structure-Persistent 3D Talking Head Synthesis via Gaussian Splatting
par: Li, Jiahe, et autres
Publié: (2024)
par: Li, Jiahe, et autres
Publié: (2024)
Focus on Neighbors and Know the Whole: Towards Consistent Dense Multiview Text-to-Image Generator for 3D Creation
par: Li, Bonan, et autres
Publié: (2024)
par: Li, Bonan, et autres
Publié: (2024)
StyleTokenizer: Defining Image Style by a Single Instance for Controlling Diffusion Models
par: Li, Wen, et autres
Publié: (2024)
par: Li, Wen, et autres
Publié: (2024)
SyncTalk: The Devil is in the Synchronization for Talking Head Synthesis
par: Peng, Ziqiao, et autres
Publié: (2023)
par: Peng, Ziqiao, et autres
Publié: (2023)
FixTalk: Taming Identity Leakage for High-Quality Talking Head Generation in Extreme Cases
par: Tan, Shuai, et autres
Publié: (2025)
par: Tan, Shuai, et autres
Publié: (2025)
On the optimal pivot path of simplex method for linear programming based on reinforcement learning
par: Li, Anqi, et autres
Publié: (2022)
par: Li, Anqi, et autres
Publié: (2022)
SyncTalk++: High-Fidelity and Efficient Synchronized Talking Heads Synthesis Using Gaussian Splatting
par: Peng, Ziqiao, et autres
Publié: (2025)
par: Peng, Ziqiao, et autres
Publié: (2025)
Blaze3DM: Marry Triplane Representation with Diffusion for 3D Medical Inverse Problem Solving
par: He, Jia, et autres
Publié: (2024)
par: He, Jia, et autres
Publié: (2024)
TalkVid: A Large-Scale Diversified Dataset for Audio-Driven Talking Head Synthesis
par: Chen, Shunian, et autres
Publié: (2025)
par: Chen, Shunian, et autres
Publié: (2025)
EmoTalkingGaussian: Continuous Emotion-conditioned Talking Head Synthesis
par: Cha, Junuk, et autres
Publié: (2025)
par: Cha, Junuk, et autres
Publié: (2025)
A Comprehensive Taxonomy and Analysis of Talking Head Synthesis: Techniques for Portrait Generation, Driving Mechanisms, and Editing
par: Meng, Ming, et autres
Publié: (2024)
par: Meng, Ming, et autres
Publié: (2024)
A-PSRO: A Unified Strategy Learning Method with Advantage Function for Normal-form Games
par: Hu, Yudong, et autres
Publié: (2023)
par: Hu, Yudong, et autres
Publié: (2023)
EmoTalk3D: High-Fidelity Free-View Synthesis of Emotional 3D Talking Head
par: He, Qianyun, et autres
Publié: (2024)
par: He, Qianyun, et autres
Publié: (2024)
HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis
par: Liu, Shiyu, et autres
Publié: (2025)
par: Liu, Shiyu, et autres
Publié: (2025)
Who is a Better Talker: Subjective and Objective Quality Assessment for AI-Generated Talking Heads
par: Zhou, Yingjie, et autres
Publié: (2025)
par: Zhou, Yingjie, et autres
Publié: (2025)
MMTalker: Multiresolution 3D Talking Head Synthesis with Multimodal Feature Fusion
par: Liu, Bin, et autres
Publié: (2026)
par: Liu, Bin, et autres
Publié: (2026)
EDTalk: Efficient Disentanglement for Emotional Talking Head Synthesis
par: Tan, Shuai, et autres
Publié: (2024)
par: Tan, Shuai, et autres
Publié: (2024)
EDTalk++: Full Disentanglement for Controllable Talking Head Synthesis
par: Tan, Shuai, et autres
Publié: (2025)
par: Tan, Shuai, et autres
Publié: (2025)
EmbedTalk: Triplane-Free Talking Head Synthesis using Embedding-Driven Gaussian Deformation
par: Saggar, Arpita, et autres
Publié: (2026)
par: Saggar, Arpita, et autres
Publié: (2026)
TalkingHeadBench: A Multi-Modal Benchmark & Analysis of Talking-Head DeepFake Detection
par: Xiong, Xinqi, et autres
Publié: (2025)
par: Xiong, Xinqi, et autres
Publié: (2025)
StyGazeTalk: Learning Stylized Generation of Gaze and Head Dynamics
par: Shi, Chengwei, et autres
Publié: (2025)
par: Shi, Chengwei, et autres
Publié: (2025)
A Comparative Study of Perceptual Quality Metrics for Audio-driven Talking Head Videos
par: Zhang, Weixia, et autres
Publié: (2024)
par: Zhang, Weixia, et autres
Publié: (2024)
Animate-X: Universal Character Image Animation with Enhanced Motion Representation
par: Tan, Shuai, et autres
Publié: (2024)
par: Tan, Shuai, et autres
Publié: (2024)
Jump Cut Smoothing for Talking Heads
par: Wang, Xiaojuan, et autres
Publié: (2024)
par: Wang, Xiaojuan, et autres
Publié: (2024)
InsTaG: Learning Personalized 3D Talking Head from Few-Second Video
par: Li, Jiahe, et autres
Publié: (2025)
par: Li, Jiahe, et autres
Publié: (2025)
S^3D-NeRF: Single-Shot Speech-Driven Neural Radiance Field for High Fidelity Talking Head Synthesis
par: Li, Dongze, et autres
Publié: (2024)
par: Li, Dongze, et autres
Publié: (2024)
Monocular and Generalizable Gaussian Talking Head Animation
par: Gong, Shengjie, et autres
Publié: (2025)
par: Gong, Shengjie, et autres
Publié: (2025)
DSConv: Dynamic Splitting Convolution for Pansharpening
par: Liu, Xuanyu, et autres
Publié: (2025)
par: Liu, Xuanyu, et autres
Publié: (2025)
Deformable NeRF using Recursively Subdivided Tetrahedra
par: Qiu, Zherui, et autres
Publié: (2024)
par: Qiu, Zherui, et autres
Publié: (2024)
Distillation Dynamics: Towards Understanding Feature-Based Distillation in Vision Transformers
par: Tian, Huiyuan, et autres
Publié: (2025)
par: Tian, Huiyuan, et autres
Publié: (2025)
Documents similaires
-
LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis
par: Li, Tianqi, et autres
Publié: (2024) -
Ditto: Motion-Space Diffusion for Controllable Realtime Talking Head Synthesis
par: Li, Tianqi, et autres
Publié: (2024) -
DR-BFR: Degradation Representation with Diffusion Models for Blind Face Restoration
par: Qiu, Xinmin, et autres
Publié: (2024) -
BlazeBVD: Make Scale-Time Equalization Great Again for Blind Video Deflickering
par: Qiu, Xinmin, et autres
Publié: (2024) -
StyO: Stylize Your Face in Only One-shot
par: Li, Bonan, et autres
Publié: (2023)