StyleTalk++: A Unified Framework for Controlling the Speaking Styles of Talking Heads
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Suzhen, Ma, Yifeng, Ding, Yu, Hu, Zhipeng, Fan, Changjie, Lv, Tangjie, Deng, Zhidong, Yu, Xin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles
por: Ma, Yifeng, et al.
Publicado: (2023)
por: Ma, Yifeng, et al.
Publicado: (2023)
StyleTalker: One-shot Style-based Audio-driven Talking Head Video Generation
por: Min, Dongchan, et al.
Publicado: (2022)
por: Min, Dongchan, et al.
Publicado: (2022)
DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
por: Ma, Yifeng, et al.
Publicado: (2023)
por: Ma, Yifeng, et al.
Publicado: (2023)
Style2Talker: High-Resolution Talking Head Generation with Emotion Style and Art Style
por: Tan, Shuai, et al.
Publicado: (2024)
por: Tan, Shuai, et al.
Publicado: (2024)
Towards a Simultaneous and Granular Identity-Expression Control in Personalized Face Generation
por: Liu, Renshuai, et al.
Publicado: (2024)
por: Liu, Renshuai, et al.
Publicado: (2024)
SVP: Style-Enhanced Vivid Portrait Talking Head Diffusion Model
por: Tan, Weipeng, et al.
Publicado: (2024)
por: Tan, Weipeng, et al.
Publicado: (2024)
Audio-driven High-resolution Seamless Talking Head Video Editing via StyleGAN
por: Su, Jiacheng, et al.
Publicado: (2024)
por: Su, Jiacheng, et al.
Publicado: (2024)
SyncTalk: The Devil is in the Synchronization for Talking Head Synthesis
por: Peng, Ziqiao, et al.
Publicado: (2023)
por: Peng, Ziqiao, et al.
Publicado: (2023)
DiTalker: A Unified DiT-based Framework for High-Quality and Speaking Styles Controllable Portrait Animation
por: Feng, He, et al.
Publicado: (2025)
por: Feng, He, et al.
Publicado: (2025)
MoCoTalk: Multi-Conditional Diffusion with Adaptive Router for Controllable Talking Head Generation
por: Ye, Xinyan, et al.
Publicado: (2026)
por: Ye, Xinyan, et al.
Publicado: (2026)
Toward Fine-Grained Facial Control in 3D Talking Head Generation
por: Xie, Shaoyang, et al.
Publicado: (2026)
por: Xie, Shaoyang, et al.
Publicado: (2026)
SyncTalk++: High-Fidelity and Efficient Synchronized Talking Heads Synthesis Using Gaussian Splatting
por: Peng, Ziqiao, et al.
Publicado: (2025)
por: Peng, Ziqiao, et al.
Publicado: (2025)
PTalker: Personalized Speech-Driven 3D Talking Head Animation via Style Disentanglement and Modality Alignment
por: Wang, Bin, et al.
Publicado: (2025)
por: Wang, Bin, et al.
Publicado: (2025)
OT-Talk: Animating 3D Talking Head with Optimal Transportation
por: Wang, Xinmu, et al.
Publicado: (2025)
por: Wang, Xinmu, et al.
Publicado: (2025)
TalkingHeadBench: A Multi-Modal Benchmark & Analysis of Talking-Head DeepFake Detection
por: Xiong, Xinqi, et al.
Publicado: (2025)
por: Xiong, Xinqi, et al.
Publicado: (2025)
ConsistTalk: Intensity Controllable Temporally Consistent Talking Head Generation with Diffusion Noise Search
por: Liu, Zhenjie, et al.
Publicado: (2025)
por: Liu, Zhenjie, et al.
Publicado: (2025)
IRConStyle: Image Restoration Framework Using Contrastive Learning and Style Transfer
por: Fan, Dongqi, et al.
Publicado: (2024)
por: Fan, Dongqi, et al.
Publicado: (2024)
EmoTalkingGaussian: Continuous Emotion-conditioned Talking Head Synthesis
por: Cha, Junuk, et al.
Publicado: (2025)
por: Cha, Junuk, et al.
Publicado: (2025)
FreeTalk: Emotional Topology-Free 3D Talking Heads
por: Nocentini, Federico, et al.
Publicado: (2026)
por: Nocentini, Federico, et al.
Publicado: (2026)
ScanTalk: 3D Talking Heads from Unregistered Scans
por: Nocentini, Federico, et al.
Publicado: (2024)
por: Nocentini, Federico, et al.
Publicado: (2024)
TalkingGaussian: Structure-Persistent 3D Talking Head Synthesis via Gaussian Splatting
por: Li, Jiahe, et al.
Publicado: (2024)
por: Li, Jiahe, et al.
Publicado: (2024)
THEval. Evaluation Framework for Talking Head Video Generation
por: Quignon, Nabyl, et al.
Publicado: (2025)
por: Quignon, Nabyl, et al.
Publicado: (2025)
EDTalk++: Full Disentanglement for Controllable Talking Head Synthesis
por: Tan, Shuai, et al.
Publicado: (2025)
por: Tan, Shuai, et al.
Publicado: (2025)
EmoDiffTalk:Emotion-aware Diffusion for Editable 3D Gaussian Talking Head
por: Liu, Chang, et al.
Publicado: (2025)
por: Liu, Chang, et al.
Publicado: (2025)
Monocular and Generalizable Gaussian Talking Head Animation
por: Gong, Shengjie, et al.
Publicado: (2025)
por: Gong, Shengjie, et al.
Publicado: (2025)
GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
por: Agarwal, Madhav, et al.
Publicado: (2025)
por: Agarwal, Madhav, et al.
Publicado: (2025)
Talking Head Generation via AU-Guided Landmark Prediction
por: Chang, Shao-Yu, et al.
Publicado: (2025)
por: Chang, Shao-Yu, et al.
Publicado: (2025)
DualTalk: Dual-Speaker Interaction for 3D Talking Head Conversations
por: Peng, Ziqiao, et al.
Publicado: (2025)
por: Peng, Ziqiao, et al.
Publicado: (2025)
VAST: Vivify Your Talking Avatar via Zero-Shot Expressive Facial Style Transfer
por: Chen, Liyang, et al.
Publicado: (2023)
por: Chen, Liyang, et al.
Publicado: (2023)
EmoHead: Emotional Talking Head via Manipulating Semantic Expression Parameters
por: Shen, Xuli, et al.
Publicado: (2025)
por: Shen, Xuli, et al.
Publicado: (2025)
UniTalking: A Unified Audio-Video Framework for Talking Portrait Generation
por: Li, Hebeizi, et al.
Publicado: (2026)
por: Li, Hebeizi, et al.
Publicado: (2026)
Jump Cut Smoothing for Talking Heads
por: Wang, Xiaojuan, et al.
Publicado: (2024)
por: Wang, Xiaojuan, et al.
Publicado: (2024)
MRStyle: A Unified Framework for Color Style Transfer with Multi-Modality Reference
por: Huang, Jiancheng, et al.
Publicado: (2024)
por: Huang, Jiancheng, et al.
Publicado: (2024)
GaussianTalker: Speaker-specific Talking Head Synthesis via 3D Gaussian Splatting
por: Yu, Hongyun, et al.
Publicado: (2024)
por: Yu, Hongyun, et al.
Publicado: (2024)
SoulX-FlashHead: Oracle-guided Generation of Infinite Real-time Streaming Talking Heads
por: Yu, Tan, et al.
Publicado: (2026)
por: Yu, Tan, et al.
Publicado: (2026)
GaussianStyle: Gaussian Head Avatar via StyleGAN
por: Liu, Pinxin, et al.
Publicado: (2024)
por: Liu, Pinxin, et al.
Publicado: (2024)
FixTalk: Taming Identity Leakage for High-Quality Talking Head Generation in Extreme Cases
por: Tan, Shuai, et al.
Publicado: (2025)
por: Tan, Shuai, et al.
Publicado: (2025)
TalkVid: A Large-Scale Diversified Dataset for Audio-Driven Talking Head Synthesis
por: Chen, Shunian, et al.
Publicado: (2025)
por: Chen, Shunian, et al.
Publicado: (2025)
EmbedTalk: Triplane-Free Talking Head Synthesis using Embedding-Driven Gaussian Deformation
por: Saggar, Arpita, et al.
Publicado: (2026)
por: Saggar, Arpita, et al.
Publicado: (2026)
ActAvatar: Temporally-Aware Precise Action Control for Talking Avatars
por: Peng, Ziqiao, et al.
Publicado: (2025)
por: Peng, Ziqiao, et al.
Publicado: (2025)
Ejemplares similares
-
TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles
por: Ma, Yifeng, et al.
Publicado: (2023) -
StyleTalker: One-shot Style-based Audio-driven Talking Head Video Generation
por: Min, Dongchan, et al.
Publicado: (2022) -
DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
por: Ma, Yifeng, et al.
Publicado: (2023) -
Style2Talker: High-Resolution Talking Head Generation with Emotion Style and Art Style
por: Tan, Shuai, et al.
Publicado: (2024) -
Towards a Simultaneous and Granular Identity-Expression Control in Personalized Face Generation
por: Liu, Renshuai, et al.
Publicado: (2024)