Jump Cut Smoothing for Talking Heads
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Xiaojuan, Park, Taesung, Zhou, Yang, Shechtman, Eli, Zhang, Richard |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Customizing Text-to-Image Diffusion with Object Viewpoint Control
di: Kumari, Nupur, et al.
Pubblicazione: (2024)
di: Kumari, Nupur, et al.
Pubblicazione: (2024)
Editable Image Elements for Controllable Synthesis
di: Mu, Jiteng, et al.
Pubblicazione: (2024)
di: Mu, Jiteng, et al.
Pubblicazione: (2024)
Improved Distribution Matching Distillation for Fast Image Synthesis
di: Yin, Tianwei, et al.
Pubblicazione: (2024)
di: Yin, Tianwei, et al.
Pubblicazione: (2024)
One-step Diffusion with Distribution Matching Distillation
di: Yin, Tianwei, et al.
Pubblicazione: (2023)
di: Yin, Tianwei, et al.
Pubblicazione: (2023)
VideoGigaGAN: Towards Detail-rich Video Super-Resolution
di: Xu, Yiran, et al.
Pubblicazione: (2024)
di: Xu, Yiran, et al.
Pubblicazione: (2024)
Lazy Diffusion Transformer for Interactive Image Editing
di: Nitzan, Yotam, et al.
Pubblicazione: (2024)
di: Nitzan, Yotam, et al.
Pubblicazione: (2024)
Distilling Diffusion Models into Conditional GANs
di: Kang, Minguk, et al.
Pubblicazione: (2024)
di: Kang, Minguk, et al.
Pubblicazione: (2024)
Image Neural Field Diffusion Models
di: Chen, Yinbo, et al.
Pubblicazione: (2024)
di: Chen, Yinbo, et al.
Pubblicazione: (2024)
NewMove: Customizing text-to-video models with novel motions
di: Materzynska, Joanna, et al.
Pubblicazione: (2023)
di: Materzynska, Joanna, et al.
Pubblicazione: (2023)
DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
SyncTalk: The Devil is in the Synchronization for Talking Head Synthesis
di: Peng, Ziqiao, et al.
Pubblicazione: (2023)
di: Peng, Ziqiao, et al.
Pubblicazione: (2023)
TurboEdit: Instant text-based image editing
di: Wu, Zongze, et al.
Pubblicazione: (2024)
di: Wu, Zongze, et al.
Pubblicazione: (2024)
Identifying Prompted Artist Names from Generated Images
di: Su, Grace, et al.
Pubblicazione: (2025)
di: Su, Grace, et al.
Pubblicazione: (2025)
GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
di: Agarwal, Madhav, et al.
Pubblicazione: (2025)
di: Agarwal, Madhav, et al.
Pubblicazione: (2025)
TalkingGaussian: Structure-Persistent 3D Talking Head Synthesis via Gaussian Splatting
di: Li, Jiahe, et al.
Pubblicazione: (2024)
di: Li, Jiahe, et al.
Pubblicazione: (2024)
From Slow Bidirectional to Fast Autoregressive Video Diffusion Models
di: Yin, Tianwei, et al.
Pubblicazione: (2024)
di: Yin, Tianwei, et al.
Pubblicazione: (2024)
Learning Dynamic Tetrahedra for High-Quality Talking Head Synthesis
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
TalkVid: A Large-Scale Diversified Dataset for Audio-Driven Talking Head Synthesis
di: Chen, Shunian, et al.
Pubblicazione: (2025)
di: Chen, Shunian, et al.
Pubblicazione: (2025)
StyleTalk++: A Unified Framework for Controlling the Speaking Styles of Talking Heads
di: Wang, Suzhen, et al.
Pubblicazione: (2024)
di: Wang, Suzhen, et al.
Pubblicazione: (2024)
TalkingHeadBench: A Multi-Modal Benchmark & Analysis of Talking-Head DeepFake Detection
di: Xiong, Xinqi, et al.
Pubblicazione: (2025)
di: Xiong, Xinqi, et al.
Pubblicazione: (2025)
TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
Self-Evaluation Unlocks Any-Step Text-to-Image Generation
di: Yu, Xin, et al.
Pubblicazione: (2025)
di: Yu, Xin, et al.
Pubblicazione: (2025)
MotionStream: Real-Time Video Generation with Interactive Motion Controls
di: Shin, Joonghyuk, et al.
Pubblicazione: (2025)
di: Shin, Joonghyuk, et al.
Pubblicazione: (2025)
EmoDiffTalk:Emotion-aware Diffusion for Editable 3D Gaussian Talking Head
di: Liu, Chang, et al.
Pubblicazione: (2025)
di: Liu, Chang, et al.
Pubblicazione: (2025)
ScanTalk: 3D Talking Heads from Unregistered Scans
di: Nocentini, Federico, et al.
Pubblicazione: (2024)
di: Nocentini, Federico, et al.
Pubblicazione: (2024)
EmoTalkingGaussian: Continuous Emotion-conditioned Talking Head Synthesis
di: Cha, Junuk, et al.
Pubblicazione: (2025)
di: Cha, Junuk, et al.
Pubblicazione: (2025)
FreeTalk: Emotional Topology-Free 3D Talking Heads
di: Nocentini, Federico, et al.
Pubblicazione: (2026)
di: Nocentini, Federico, et al.
Pubblicazione: (2026)
JOLT3D: Joint Learning of Talking Heads and 3DMM Parameters with Application to Lip-Sync
di: Park, Sungjoon, et al.
Pubblicazione: (2025)
di: Park, Sungjoon, et al.
Pubblicazione: (2025)
IF-MDM: Implicit Face Motion Diffusion Model for High-Fidelity Realtime Talking Head Generation
di: Yang, Sejong, et al.
Pubblicazione: (2024)
di: Yang, Sejong, et al.
Pubblicazione: (2024)
THEval. Evaluation Framework for Talking Head Video Generation
di: Quignon, Nabyl, et al.
Pubblicazione: (2025)
di: Quignon, Nabyl, et al.
Pubblicazione: (2025)
OT-Talk: Animating 3D Talking Head with Optimal Transportation
di: Wang, Xinmu, et al.
Pubblicazione: (2025)
di: Wang, Xinmu, et al.
Pubblicazione: (2025)
ConsistTalk: Intensity Controllable Temporally Consistent Talking Head Generation with Diffusion Noise Search
di: Liu, Zhenjie, et al.
Pubblicazione: (2025)
di: Liu, Zhenjie, et al.
Pubblicazione: (2025)
ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance
di: Yang, Haijie, et al.
Pubblicazione: (2024)
di: Yang, Haijie, et al.
Pubblicazione: (2024)
Zero4D: Training-Free 4D Video Generation From Single Video Using Off-the-Shelf Video Diffusion
di: Park, Jangho, et al.
Pubblicazione: (2025)
di: Park, Jangho, et al.
Pubblicazione: (2025)
SoulX-FlashHead: Oracle-guided Generation of Infinite Real-time Streaming Talking Heads
di: Yu, Tan, et al.
Pubblicazione: (2026)
di: Yu, Tan, et al.
Pubblicazione: (2026)
SyncTalk++: High-Fidelity and Efficient Synchronized Talking Heads Synthesis Using Gaussian Splatting
di: Peng, Ziqiao, et al.
Pubblicazione: (2025)
di: Peng, Ziqiao, et al.
Pubblicazione: (2025)
Long-Context State-Space Video World Models
di: Po, Ryan, et al.
Pubblicazione: (2025)
di: Po, Ryan, et al.
Pubblicazione: (2025)
EMOdiffhead: Continuously Emotional Control in Talking Head Generation via Diffusion
di: Zhang, Jian, et al.
Pubblicazione: (2024)
di: Zhang, Jian, et al.
Pubblicazione: (2024)
PTalker: Personalized Speech-Driven 3D Talking Head Animation via Style Disentanglement and Modality Alignment
di: Wang, Bin, et al.
Pubblicazione: (2025)
di: Wang, Bin, et al.
Pubblicazione: (2025)
Monocular and Generalizable Gaussian Talking Head Animation
di: Gong, Shengjie, et al.
Pubblicazione: (2025)
di: Gong, Shengjie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Customizing Text-to-Image Diffusion with Object Viewpoint Control
di: Kumari, Nupur, et al.
Pubblicazione: (2024) -
Editable Image Elements for Controllable Synthesis
di: Mu, Jiteng, et al.
Pubblicazione: (2024) -
Improved Distribution Matching Distillation for Fast Image Synthesis
di: Yin, Tianwei, et al.
Pubblicazione: (2024) -
One-step Diffusion with Distribution Matching Distillation
di: Yin, Tianwei, et al.
Pubblicazione: (2023) -
VideoGigaGAN: Towards Detail-rich Video Super-Resolution
di: Xu, Yiran, et al.
Pubblicazione: (2024)