FREAK: Frequency-modulated High-fidelity and Real-time Audio-driven Talking Portrait Synthesis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ni, Ziqi, Fu, Ao, Zhou, Yi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Dual Audio-Centric Modality Coupling for Talking Head Generation
par: Fu, Ao, et autres
Publié: (2025)
par: Fu, Ao, et autres
Publié: (2025)
Real3D-Portrait: One-shot Realistic 3D Talking Portrait Synthesis
par: Ye, Zhenhui, et autres
Publié: (2024)
par: Ye, Zhenhui, et autres
Publié: (2024)
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
par: Fei, Zhengcong, et autres
Publié: (2025)
par: Fei, Zhengcong, et autres
Publié: (2025)
UniTalking: A Unified Audio-Video Framework for Talking Portrait Generation
par: Li, Hebeizi, et autres
Publié: (2026)
par: Li, Hebeizi, et autres
Publié: (2026)
MegaPortrait: Revisiting Diffusion Control for High-fidelity Portrait Generation
par: Yang, Han, et autres
Publié: (2024)
par: Yang, Han, et autres
Publié: (2024)
Unlock Pose Diversity: Accurate and Efficient Implicit Keypoint-based Spatiotemporal Diffusion for Audio-driven Talking Portrait
par: Yang, Chaolong, et autres
Publié: (2025)
par: Yang, Chaolong, et autres
Publié: (2025)
FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis
par: Wang, Mengchao, et autres
Publié: (2025)
par: Wang, Mengchao, et autres
Publié: (2025)
Real-time 3D-aware Portrait Video Relighting
par: Cai, Ziqi, et autres
Publié: (2024)
par: Cai, Ziqi, et autres
Publié: (2024)
Talk3D: High-Fidelity Talking Portrait Synthesis via Personalized 3D Generative Prior
par: Ko, Jaehoon, et autres
Publié: (2024)
par: Ko, Jaehoon, et autres
Publié: (2024)
GMTalker: Gaussian Mixture-based Audio-Driven Emotional Talking Video Portraits
par: Xia, Yibo, et autres
Publié: (2023)
par: Xia, Yibo, et autres
Publié: (2023)
EvalTalker: Learning to Evaluate Real-Portrait-Driven Multi-Subject Talking Humans
par: Zhou, Yingjie, et autres
Publié: (2025)
par: Zhou, Yingjie, et autres
Publié: (2025)
RAP: Real-time Audio-driven Portrait Animation with Video Diffusion Transformer
par: Du, Fangyu, et autres
Publié: (2025)
par: Du, Fangyu, et autres
Publié: (2025)
PortraitTalk: Towards Customizable One-Shot Audio-to-Talking Face Generation
par: Nazarieh, Fatemeh, et autres
Publié: (2024)
par: Nazarieh, Fatemeh, et autres
Publié: (2024)
FantasyTalking2: Timestep-Layer Adaptive Preference Optimization for Audio-Driven Portrait Animation
par: Wang, MengChao, et autres
Publié: (2025)
par: Wang, MengChao, et autres
Publié: (2025)
RealTalk: Real-time and Realistic Audio-driven Face Generation with 3D Facial Prior-guided Identity Alignment Network
par: Ji, Xiaozhong, et autres
Publié: (2024)
par: Ji, Xiaozhong, et autres
Publié: (2024)
HiFi-Portrait: Zero-shot Identity-preserved Portrait Generation with High-fidelity Multi-face Fusion
par: Xu, Yifang, et autres
Publié: (2025)
par: Xu, Yifang, et autres
Publié: (2025)
GSTalker: Real-time Audio-Driven Talking Face Generation via Deformable Gaussian Splatting
par: Chen, Bo, et autres
Publié: (2024)
par: Chen, Bo, et autres
Publié: (2024)
FREAK: A Fine-grained Hallucination Evaluation Benchmark for Advanced MLLMs
par: Yin, Zhihan, et autres
Publié: (2026)
par: Yin, Zhihan, et autres
Publié: (2026)
Teller: Real-Time Streaming Audio-Driven Portrait Animation with Autoregressive Motion Generation
par: Zhen, Dingcheng, et autres
Publié: (2025)
par: Zhen, Dingcheng, et autres
Publié: (2025)
Real-time One-Step Diffusion-based Expressive Portrait Videos Generation
par: Guo, Hanzhong, et autres
Publié: (2024)
par: Guo, Hanzhong, et autres
Publié: (2024)
SVP: Style-Enhanced Vivid Portrait Talking Head Diffusion Model
par: Tan, Weipeng, et autres
Publié: (2024)
par: Tan, Weipeng, et autres
Publié: (2024)
FLOAT: Generative Motion Latent Flow Matching for Audio-driven Talking Portrait
par: Ki, Taekyung, et autres
Publié: (2024)
par: Ki, Taekyung, et autres
Publié: (2024)
Audio-driven Talking Face Generation with Stabilized Synchronization Loss
par: Yaman, Dogucan, et autres
Publié: (2023)
par: Yaman, Dogucan, et autres
Publié: (2023)
TokTalk: Expressive Real-time Facial Animation from Audio-LLM Tokens
par: Zhao, Qingcheng, et autres
Publié: (2026)
par: Zhao, Qingcheng, et autres
Publié: (2026)
Real-Time Generation of Streamable Talking Portrait Video with Reference-Guided Deep Compression VAEs
par: Xu, Sicheng, et autres
Publié: (2026)
par: Xu, Sicheng, et autres
Publié: (2026)
Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation
par: Xu, Mingwang, et autres
Publié: (2024)
par: Xu, Mingwang, et autres
Publié: (2024)
Audio-driven High-resolution Seamless Talking Head Video Editing via StyleGAN
par: Su, Jiacheng, et autres
Publié: (2024)
par: Su, Jiacheng, et autres
Publié: (2024)
AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation
par: Wei, Huawei, et autres
Publié: (2024)
par: Wei, Huawei, et autres
Publié: (2024)
Splat-Portrait: Generalizing Talking Heads with Gaussian Splatting
par: Shi, Tong, et autres
Publié: (2026)
par: Shi, Tong, et autres
Publié: (2026)
Disentangle Identity, Cooperate Emotion: Correlation-Aware Emotional Talking Portrait Generation
par: Tan, Weipeng, et autres
Publié: (2025)
par: Tan, Weipeng, et autres
Publié: (2025)
Text-driven Talking Face Synthesis by Reprogramming Audio-driven Models
par: Choi, Jeongsoo, et autres
Publié: (2023)
par: Choi, Jeongsoo, et autres
Publié: (2023)
READ: Real-time and Efficient Asynchronous Diffusion for Audio-driven Talking Head Generation
par: Wang, Haotian, et autres
Publié: (2025)
par: Wang, Haotian, et autres
Publié: (2025)
Dimitra: Audio-driven Diffusion model for Expressive Talking Head Generation
par: Chopin, Baptiste, et autres
Publié: (2025)
par: Chopin, Baptiste, et autres
Publié: (2025)
GaussianTalker: Real-Time High-Fidelity Talking Head Synthesis with Audio-Driven 3D Gaussian Splatting
par: Cho, Kyusun, et autres
Publié: (2024)
par: Cho, Kyusun, et autres
Publié: (2024)
TalkVid: A Large-Scale Diversified Dataset for Audio-Driven Talking Head Synthesis
par: Chen, Shunian, et autres
Publié: (2025)
par: Chen, Shunian, et autres
Publié: (2025)
A Comprehensive Taxonomy and Analysis of Talking Head Synthesis: Techniques for Portrait Generation, Driving Mechanisms, and Editing
par: Meng, Ming, et autres
Publié: (2024)
par: Meng, Ming, et autres
Publié: (2024)
Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation
par: Cui, Jiahao, et autres
Publié: (2024)
par: Cui, Jiahao, et autres
Publié: (2024)
NeRFFaceSpeech: One-shot Audio-driven 3D Talking Head Synthesis via Generative Prior
par: Kim, Gihoon, et autres
Publié: (2024)
par: Kim, Gihoon, et autres
Publié: (2024)
InfiniteTalk: Audio-driven Video Generation for Sparse-Frame Video Dubbing
par: Yang, Shaoshu, et autres
Publié: (2025)
par: Yang, Shaoshu, et autres
Publié: (2025)
GoHD: Gaze-oriented and Highly Disentangled Portrait Animation with Rhythmic Poses and Realistic Expression
par: Zhou, Ziqi, et autres
Publié: (2024)
par: Zhou, Ziqi, et autres
Publié: (2024)
Documents similaires
-
Dual Audio-Centric Modality Coupling for Talking Head Generation
par: Fu, Ao, et autres
Publié: (2025) -
Real3D-Portrait: One-shot Realistic 3D Talking Portrait Synthesis
par: Ye, Zhenhui, et autres
Publié: (2024) -
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
par: Fei, Zhengcong, et autres
Publié: (2025) -
UniTalking: A Unified Audio-Video Framework for Talking Portrait Generation
par: Li, Hebeizi, et autres
Publié: (2026) -
MegaPortrait: Revisiting Diffusion Control for High-fidelity Portrait Generation
par: Yang, Han, et autres
Publié: (2024)