AVI-Talking: Learning Audio-Visual Instructions for Expressive 3D Talking Face Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Sun, Yasheng, Chu, Wenqing, Zhou, Hang, Wang, Kaisiyuan, Koike, Hideki |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Cosh-DiT: Co-Speech Gesture Video Synthesis via Hybrid Audio-Visual Diffusion Transformers
di: Sun, Yasheng, et al.
Pubblicazione: (2025)
di: Sun, Yasheng, et al.
Pubblicazione: (2025)
Dimitra: Audio-driven Diffusion model for Expressive Talking Head Generation
di: Chopin, Baptiste, et al.
Pubblicazione: (2025)
di: Chopin, Baptiste, et al.
Pubblicazione: (2025)
EmoGene: Audio-Driven Emotional 3D Talking-Head Generation
di: Wang, Wenqing, et al.
Pubblicazione: (2024)
di: Wang, Wenqing, et al.
Pubblicazione: (2024)
Learn2Talk: 3D Talking Face Learns from 2D Talking Face
di: Zhuang, Yixiang, et al.
Pubblicazione: (2024)
di: Zhuang, Yixiang, et al.
Pubblicazione: (2024)
MAGIC-Talk: Motion-aware Audio-Driven Talking Face Generation with Customizable Identity Control
di: Nazarieh, Fatemeh, et al.
Pubblicazione: (2025)
di: Nazarieh, Fatemeh, et al.
Pubblicazione: (2025)
PC-Talk: Precise Facial Animation Control for Audio-Driven Talking Face Generation
di: Wang, Baiqin, et al.
Pubblicazione: (2025)
di: Wang, Baiqin, et al.
Pubblicazione: (2025)
EmotiveTalk: Expressive Talking Head Generation through Audio Information Decoupling and Emotional Video Diffusion
di: Wang, Haotian, et al.
Pubblicazione: (2024)
di: Wang, Haotian, et al.
Pubblicazione: (2024)
TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
Audio-Visual Speech Representation Expert for Enhanced Talking Face Video Generation and Evaluation
di: Yaman, Dogucan, et al.
Pubblicazione: (2024)
di: Yaman, Dogucan, et al.
Pubblicazione: (2024)
Audio-driven Talking Face Generation with Stabilized Synchronization Loss
di: Yaman, Dogucan, et al.
Pubblicazione: (2023)
di: Yaman, Dogucan, et al.
Pubblicazione: (2023)
Mask-Free Audio-driven Talking Face Generation for Enhanced Visual Quality and Identity Preservation
di: Yaman, Dogucan, et al.
Pubblicazione: (2025)
di: Yaman, Dogucan, et al.
Pubblicazione: (2025)
Joint Co-Speech Gesture and Expressive Talking Face Generation using Diffusion with Adapters
di: Hogue, Steven, et al.
Pubblicazione: (2024)
di: Hogue, Steven, et al.
Pubblicazione: (2024)
PortraitTalk: Towards Customizable One-Shot Audio-to-Talking Face Generation
di: Nazarieh, Fatemeh, et al.
Pubblicazione: (2024)
di: Nazarieh, Fatemeh, et al.
Pubblicazione: (2024)
SwapTalk: Audio-Driven Talking Face Generation with One-Shot Customization in Latent Space
di: Zhang, Zeren, et al.
Pubblicazione: (2024)
di: Zhang, Zeren, et al.
Pubblicazione: (2024)
Audio-Driven Talking Face Video Generation with Joint Uncertainty Learning
di: Xie, Yifan, et al.
Pubblicazione: (2025)
di: Xie, Yifan, et al.
Pubblicazione: (2025)
JoyGen: Audio-Driven 3D Depth-Aware Talking-Face Video Editing
di: Wang, Qili, et al.
Pubblicazione: (2025)
di: Wang, Qili, et al.
Pubblicazione: (2025)
VASA-1: Lifelike Audio-Driven Talking Faces Generated in Real Time
di: Xu, Sicheng, et al.
Pubblicazione: (2024)
di: Xu, Sicheng, et al.
Pubblicazione: (2024)
UniTalking: A Unified Audio-Video Framework for Talking Portrait Generation
di: Li, Hebeizi, et al.
Pubblicazione: (2026)
di: Li, Hebeizi, et al.
Pubblicazione: (2026)
Context-aware Talking Face Video Generation
di: Xuanyuan, Meidai, et al.
Pubblicazione: (2024)
di: Xuanyuan, Meidai, et al.
Pubblicazione: (2024)
FaceChain-ImagineID: Freely Crafting High-Fidelity Diverse Talking Faces from Disentangled Audio
di: Xu, Chao, et al.
Pubblicazione: (2024)
di: Xu, Chao, et al.
Pubblicazione: (2024)
ISExplore:Informative Segment Selection for Efficient Personalized 3D Talking Face Generation
di: Sun, Rui-Qing, et al.
Pubblicazione: (2025)
di: Sun, Rui-Qing, et al.
Pubblicazione: (2025)
Audio-Driven Talking Face Generation with Blink Embedding and Hash Grid Landmarks Encoding
di: Zhang, Yuhui, et al.
Pubblicazione: (2026)
di: Zhang, Yuhui, et al.
Pubblicazione: (2026)
JEAN: Joint Expression and Audio-guided NeRF-based Talking Face Generation
di: Chakkera, Sai Tanmay Reddy, et al.
Pubblicazione: (2024)
di: Chakkera, Sai Tanmay Reddy, et al.
Pubblicazione: (2024)
Cafe-Talk: Generating 3D Talking Face Animation with Multimodal Coarse- and Fine-grained Control
di: Chen, Hejia, et al.
Pubblicazione: (2025)
di: Chen, Hejia, et al.
Pubblicazione: (2025)
GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
di: Agarwal, Madhav, et al.
Pubblicazione: (2025)
di: Agarwal, Madhav, et al.
Pubblicazione: (2025)
TokTalk: Expressive Real-time Facial Animation from Audio-LLM Tokens
di: Zhao, Qingcheng, et al.
Pubblicazione: (2026)
di: Zhao, Qingcheng, et al.
Pubblicazione: (2026)
3DXTalker: Unifying Identity, Lip Sync, Emotion, and Spatial Dynamics in Expressive 3D Talking Avatars
di: Wang, Zhongju, et al.
Pubblicazione: (2026)
di: Wang, Zhongju, et al.
Pubblicazione: (2026)
MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation
di: Zheng, Longtao, et al.
Pubblicazione: (2024)
di: Zheng, Longtao, et al.
Pubblicazione: (2024)
RealTalk: Real-time and Realistic Audio-driven Face Generation with 3D Facial Prior-guided Identity Alignment Network
di: Ji, Xiaozhong, et al.
Pubblicazione: (2024)
di: Ji, Xiaozhong, et al.
Pubblicazione: (2024)
GSTalker: Real-time Audio-Driven Talking Face Generation via Deformable Gaussian Splatting
di: Chen, Bo, et al.
Pubblicazione: (2024)
di: Chen, Bo, et al.
Pubblicazione: (2024)
IMTalker: Efficient Audio-driven Talking Face Generation with Implicit Motion Transfer
di: Chen, Bo, et al.
Pubblicazione: (2025)
di: Chen, Bo, et al.
Pubblicazione: (2025)
Versatile Multimodal Controls for Expressive Talking Human Animation
di: Qin, Zheng, et al.
Pubblicazione: (2025)
di: Qin, Zheng, et al.
Pubblicazione: (2025)
Taming Transformer for Emotion-Controllable Talking Face Generation
di: Zhang, Ziqi, et al.
Pubblicazione: (2025)
di: Zhang, Ziqi, et al.
Pubblicazione: (2025)
Talk3D: High-Fidelity Talking Portrait Synthesis via Personalized 3D Generative Prior
di: Ko, Jaehoon, et al.
Pubblicazione: (2024)
di: Ko, Jaehoon, et al.
Pubblicazione: (2024)
TalkVid: A Large-Scale Diversified Dataset for Audio-Driven Talking Head Synthesis
di: Chen, Shunian, et al.
Pubblicazione: (2025)
di: Chen, Shunian, et al.
Pubblicazione: (2025)
EmoFace: Emotion-Content Disentangled Speech-Driven 3D Talking Face Animation
di: Lin, Yihong, et al.
Pubblicazione: (2024)
di: Lin, Yihong, et al.
Pubblicazione: (2024)
FreeTalk: Emotional Topology-Free 3D Talking Heads
di: Nocentini, Federico, et al.
Pubblicazione: (2026)
di: Nocentini, Federico, et al.
Pubblicazione: (2026)
ScanTalk: 3D Talking Heads from Unregistered Scans
di: Nocentini, Federico, et al.
Pubblicazione: (2024)
di: Nocentini, Federico, et al.
Pubblicazione: (2024)
TurboTalk: Progressive Distillation for One-Step Audio-Driven Talking Avatar Generation
di: Liu, Xiangyu, et al.
Pubblicazione: (2026)
di: Liu, Xiangyu, et al.
Pubblicazione: (2026)
Superior and Pragmatic Talking Face Generation with Teacher-Student Framework
di: Liang, Chao, et al.
Pubblicazione: (2024)
di: Liang, Chao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Cosh-DiT: Co-Speech Gesture Video Synthesis via Hybrid Audio-Visual Diffusion Transformers
di: Sun, Yasheng, et al.
Pubblicazione: (2025) -
Dimitra: Audio-driven Diffusion model for Expressive Talking Head Generation
di: Chopin, Baptiste, et al.
Pubblicazione: (2025) -
EmoGene: Audio-Driven Emotional 3D Talking-Head Generation
di: Wang, Wenqing, et al.
Pubblicazione: (2024) -
Learn2Talk: 3D Talking Face Learns from 2D Talking Face
di: Zhuang, Yixiang, et al.
Pubblicazione: (2024) -
MAGIC-Talk: Motion-aware Audio-Driven Talking Face Generation with Customizable Identity Control
di: Nazarieh, Fatemeh, et al.
Pubblicazione: (2025)