DAWN: Dynamic Frame Avatar with Non-autoregressive Diffusion Framework for Talking Head Video Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Cheng, Hanbo, Lin, Limin, Liu, Chenyu, Xia, Pengcheng, Hu, Pengfei, Ma, Jiefeng, Du, Jun, Pan, Jia |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Bidirectional Trained Tree-Structured Decoder for Handwritten Mathematical Expression Recognition
por: Cheng, Hanbo, et al.
Publicado: (2023)
por: Cheng, Hanbo, et al.
Publicado: (2023)
EmotiveTalk: Expressive Talking Head Generation through Audio Information Decoupling and Emotional Video Diffusion
por: Wang, Haotian, et al.
Publicado: (2024)
por: Wang, Haotian, et al.
Publicado: (2024)
SEMv3: A Fast and Robust Approach to Table Separation Line Detection
por: Qin, Chunxia, et al.
Publicado: (2024)
por: Qin, Chunxia, et al.
Publicado: (2024)
Avatar Fingerprinting for Authorized Use of Synthetic Talking-Head Videos
por: Prashnani, Ekta, et al.
Publicado: (2023)
por: Prashnani, Ekta, et al.
Publicado: (2023)
Unlocking Complex Visual Generation via Closed-Loop Verified Reasoning
por: Cheng, Hanbo, et al.
Publicado: (2026)
por: Cheng, Hanbo, et al.
Publicado: (2026)
ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance
por: Yang, Haijie, et al.
Publicado: (2024)
por: Yang, Haijie, et al.
Publicado: (2024)
From Structure to Detail: Hierarchical Distillation for Efficient Diffusion Model
por: Cheng, Hanbo, et al.
Publicado: (2025)
por: Cheng, Hanbo, et al.
Publicado: (2025)
Is It Really You? Exploring Biometric Verification Scenarios in Photorealistic Talking-Head Avatar Videos
por: Pedrouzo-Rodriguez, Laura, et al.
Publicado: (2025)
por: Pedrouzo-Rodriguez, Laura, et al.
Publicado: (2025)
StyleSpeaker: Audio-Enhanced Fine-Grained Style Modeling for Speech-Driven 3D Facial Animation
por: Yang, An, et al.
Publicado: (2025)
por: Yang, An, et al.
Publicado: (2025)
RITA: A Real-time Interactive Talking Avatars Framework
por: Cheng, Wuxinlin, et al.
Publicado: (2024)
por: Cheng, Wuxinlin, et al.
Publicado: (2024)
See then Tell: Enhancing Key Information Extraction with Vision Grounding
por: Liu, Shuhang, et al.
Publicado: (2024)
por: Liu, Shuhang, et al.
Publicado: (2024)
DiffVC: A Non-autoregressive Framework Based on Diffusion Model for Video Captioning
por: Wang, Junbo, et al.
Publicado: (2026)
por: Wang, Junbo, et al.
Publicado: (2026)
Warm Chat: Diffuse Emotion-aware Interactive Talking Head Avatar with Tree-Structured Guidance
por: Yang, Haijie, et al.
Publicado: (2025)
por: Yang, Haijie, et al.
Publicado: (2025)
EARTalking: End-to-end GPT-style Autoregressive Talking Head Synthesis with Frame-wise Control
por: Weng, Yuzhe, et al.
Publicado: (2026)
por: Weng, Yuzhe, et al.
Publicado: (2026)
SRFUND: A Multi-Granularity Hierarchical Structure Reconstruction Benchmark in Form Understanding
por: Ma, Jiefeng, et al.
Publicado: (2024)
por: Ma, Jiefeng, et al.
Publicado: (2024)
THEval. Evaluation Framework for Talking Head Video Generation
por: Quignon, Nabyl, et al.
Publicado: (2025)
por: Quignon, Nabyl, et al.
Publicado: (2025)
StyleTalk++: A Unified Framework for Controlling the Speaking Styles of Talking Heads
por: Wang, Suzhen, et al.
Publicado: (2024)
por: Wang, Suzhen, et al.
Publicado: (2024)
Supervising 3D Talking Head Avatars with Analysis-by-Audio-Synthesis
por: Daněček, Radek, et al.
Publicado: (2025)
por: Daněček, Radek, et al.
Publicado: (2025)
DocMamba: Efficient Document Pre-training with State Space Model
por: Hu, Pengfei, et al.
Publicado: (2024)
por: Hu, Pengfei, et al.
Publicado: (2024)
Generate Your Talking Avatar from Video Reference
por: Guo, Zujin, et al.
Publicado: (2026)
por: Guo, Zujin, et al.
Publicado: (2026)
ActAvatar: Temporally-Aware Precise Action Control for Talking Avatars
por: Peng, Ziqiao, et al.
Publicado: (2025)
por: Peng, Ziqiao, et al.
Publicado: (2025)
A Study of Dropout-Induced Modality Bias on Robustness to Missing Video Frames for Audio-Visual Speech Recognition
por: Dai, Yusheng, et al.
Publicado: (2024)
por: Dai, Yusheng, et al.
Publicado: (2024)
DiffusionAvatars: Deferred Diffusion for High-fidelity 3D Head Avatars
por: Kirschstein, Tobias, et al.
Publicado: (2023)
por: Kirschstein, Tobias, et al.
Publicado: (2023)
One Shot, One Talk: Whole-body Talking Avatar from a Single Image
por: Xiang, Jun, et al.
Publicado: (2024)
por: Xiang, Jun, et al.
Publicado: (2024)
Zero-1-to-A: Zero-Shot One Image to Animatable Head Avatars Using Video Diffusion
por: Zhou, Zhenglin, et al.
Publicado: (2025)
por: Zhou, Zhenglin, et al.
Publicado: (2025)
FD2Talk: Towards Generalized Talking Head Generation with Facial Decoupled Diffusion Model
por: Yao, Ziyu, et al.
Publicado: (2024)
por: Yao, Ziyu, et al.
Publicado: (2024)
DAWN: Dependency-Aware Fast Inference for Diffusion LLMs
por: Luo, Lizhuo, et al.
Publicado: (2026)
por: Luo, Lizhuo, et al.
Publicado: (2026)
UniTabNet: Bridging Vision and Language Models for Enhanced Table Structure Recognition
por: Zhang, Zhenrong, et al.
Publicado: (2024)
por: Zhang, Zhenrong, et al.
Publicado: (2024)
SyncTalk: The Devil is in the Synchronization for Talking Head Synthesis
por: Peng, Ziqiao, et al.
Publicado: (2023)
por: Peng, Ziqiao, et al.
Publicado: (2023)
DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
por: Ma, Yifeng, et al.
Publicado: (2023)
por: Ma, Yifeng, et al.
Publicado: (2023)
Preview WB-DH: Towards Whole Body Digital Human Bench for the Generation of Whole-body Talking Avatar Videos
por: Wang, Chaoyi, et al.
Publicado: (2025)
por: Wang, Chaoyi, et al.
Publicado: (2025)
Video-Driven Animation of Neural Head Avatars
por: Paier, Wolfgang, et al.
Publicado: (2024)
por: Paier, Wolfgang, et al.
Publicado: (2024)
ANOTHER NUCLEAR DAWN
por: GUTERL, FRED
Publicado: (2005)
por: GUTERL, FRED
Publicado: (2005)
InfiniteTalk: Audio-driven Video Generation for Sparse-Frame Video Dubbing
por: Yang, Shaoshu, et al.
Publicado: (2025)
por: Yang, Shaoshu, et al.
Publicado: (2025)
Enhancing the Geometric Problem-Solving Ability of Multimodal LLMs via Symbolic-Neural Integration
por: Pan, Yicheng, et al.
Publicado: (2025)
por: Pan, Yicheng, et al.
Publicado: (2025)
LightAvatar: Efficient Head Avatar as Dynamic Neural Light Field
por: Wang, Huan, et al.
Publicado: (2024)
por: Wang, Huan, et al.
Publicado: (2024)
Towards High-fidelity 3D Talking Avatar with Personalized Dynamic Texture
por: Li, Xuanchen, et al.
Publicado: (2025)
por: Li, Xuanchen, et al.
Publicado: (2025)
TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles
por: Ma, Yifeng, et al.
Publicado: (2023)
por: Ma, Yifeng, et al.
Publicado: (2023)
FlashAvatar: High-fidelity Head Avatar with Efficient Gaussian Embedding
por: Xiang, Jun, et al.
Publicado: (2023)
por: Xiang, Jun, et al.
Publicado: (2023)
EmoDiffTalk:Emotion-aware Diffusion for Editable 3D Gaussian Talking Head
por: Liu, Chang, et al.
Publicado: (2025)
por: Liu, Chang, et al.
Publicado: (2025)
Ejemplares similares
-
Bidirectional Trained Tree-Structured Decoder for Handwritten Mathematical Expression Recognition
por: Cheng, Hanbo, et al.
Publicado: (2023) -
EmotiveTalk: Expressive Talking Head Generation through Audio Information Decoupling and Emotional Video Diffusion
por: Wang, Haotian, et al.
Publicado: (2024) -
SEMv3: A Fast and Robust Approach to Table Separation Line Detection
por: Qin, Chunxia, et al.
Publicado: (2024) -
Avatar Fingerprinting for Authorized Use of Synthetic Talking-Head Videos
por: Prashnani, Ekta, et al.
Publicado: (2023) -
Unlocking Complex Visual Generation via Closed-Loop Verified Reasoning
por: Cheng, Hanbo, et al.
Publicado: (2026)