UniTalker: Scaling up Audio-Driven 3D Facial Animation through A Unified Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Fan, Xiangyu, Li, Jiaqi, Lin, Zhiqian, Xiao, Weiye, Yang, Lei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
StreamingTalker: Audio-driven 3D Facial Animation with Autoregressive Diffusion Model
di: Yang, Yifan, et al.
Pubblicazione: (2025)
di: Yang, Yifan, et al.
Pubblicazione: (2025)
UniTalking: A Unified Audio-Video Framework for Talking Portrait Generation
di: Li, Hebeizi, et al.
Pubblicazione: (2026)
di: Li, Hebeizi, et al.
Pubblicazione: (2026)
GLDiTalker: Speech-Driven 3D Facial Animation with Graph Latent Diffusion Transformer
di: Lin, Yihong, et al.
Pubblicazione: (2024)
di: Lin, Yihong, et al.
Pubblicazione: (2024)
MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization
di: Kim, Hyung Kyu, et al.
Pubblicazione: (2025)
di: Kim, Hyung Kyu, et al.
Pubblicazione: (2025)
PC-Talk: Precise Facial Animation Control for Audio-Driven Talking Face Generation
di: Wang, Baiqin, et al.
Pubblicazione: (2025)
di: Wang, Baiqin, et al.
Pubblicazione: (2025)
DiffSpeaker: Speech-Driven 3D Facial Animation with Diffusion Transformer
di: Ma, Zhiyuan, et al.
Pubblicazione: (2024)
di: Ma, Zhiyuan, et al.
Pubblicazione: (2024)
AniTalker: Animate Vivid and Diverse Talking Faces through Identity-Decoupled Facial Motion Encoding
di: Liu, Tao, et al.
Pubblicazione: (2024)
di: Liu, Tao, et al.
Pubblicazione: (2024)
UniTalker: Conversational Speech-Visual Synthesis
di: Hu, Yifan, et al.
Pubblicazione: (2025)
di: Hu, Yifan, et al.
Pubblicazione: (2025)
ESGaussianFace: Emotional and Stylized Audio-Driven Facial Animation via 3D Gaussian Splatting
di: Ma, Chuhang, et al.
Pubblicazione: (2026)
di: Ma, Chuhang, et al.
Pubblicazione: (2026)
DiTalker: A Unified DiT-based Framework for High-Quality and Speaking Styles Controllable Portrait Animation
di: Feng, He, et al.
Pubblicazione: (2025)
di: Feng, He, et al.
Pubblicazione: (2025)
UniTalk: Towards Universal Active Speaker Detection in Real World Scenarios
di: Nguyen, Le Thien Phuc, et al.
Pubblicazione: (2025)
di: Nguyen, Le Thien Phuc, et al.
Pubblicazione: (2025)
AudioFace: Language-Assisted Speech-Driven Facial Animation with Multimodal Language Models
di: Zheng, Kai, et al.
Pubblicazione: (2026)
di: Zheng, Kai, et al.
Pubblicazione: (2026)
Wav2Sem: Plug-and-Play Audio Semantic Decoupling for 3D Speech-Driven Facial Animation
di: Li, Hao, et al.
Pubblicazione: (2025)
di: Li, Hao, et al.
Pubblicazione: (2025)
LinguaLinker: Audio-Driven Portraits Animation with Implicit Facial Control Enhancement
di: Zhang, Rui, et al.
Pubblicazione: (2024)
di: Zhang, Rui, et al.
Pubblicazione: (2024)
Enhancing Speech-Driven 3D Facial Animation with Audio-Visual Guidance from Lip Reading Expert
di: EunGi, Han, et al.
Pubblicazione: (2024)
di: EunGi, Han, et al.
Pubblicazione: (2024)
Audio Driven Real-Time Facial Animation for Social Telepresence
di: Lee, Jiye, et al.
Pubblicazione: (2025)
di: Lee, Jiye, et al.
Pubblicazione: (2025)
UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation
di: Wang, Xiang, et al.
Pubblicazione: (2024)
di: Wang, Xiang, et al.
Pubblicazione: (2024)
Uni-Animator: Towards Unified Visual Colorization
di: Chen, Xinyuan, et al.
Pubblicazione: (2026)
di: Chen, Xinyuan, et al.
Pubblicazione: (2026)
AdaMesh: Personalized Facial Expressions and Head Poses for Adaptive Speech-Driven 3D Facial Animation
di: Chen, Liyang, et al.
Pubblicazione: (2023)
di: Chen, Liyang, et al.
Pubblicazione: (2023)
KMTalk: Speech-Driven 3D Facial Animation with Key Motion Embedding
di: Xu, Zhihao, et al.
Pubblicazione: (2024)
di: Xu, Zhihao, et al.
Pubblicazione: (2024)
SOLAMI: Social Vision-Language-Action Modeling for Immersive Interaction with 3D Autonomous Characters
di: Jiang, Jianping, et al.
Pubblicazione: (2024)
di: Jiang, Jianping, et al.
Pubblicazione: (2024)
3DFacePolicy: Audio-Driven 3D Facial Animation Based on Action Control
di: Sha, Xuanmeng, et al.
Pubblicazione: (2024)
di: Sha, Xuanmeng, et al.
Pubblicazione: (2024)
Stereo-Talker: Audio-driven 3D Human Synthesis with Prior-Guided Mixture-of-Experts
di: Deng, Xiang, et al.
Pubblicazione: (2024)
di: Deng, Xiang, et al.
Pubblicazione: (2024)
LSF-Animation: Label-Free Speech-Driven Facial Animation via Implicit Feature Representation
di: Lu, Xin, et al.
Pubblicazione: (2025)
di: Lu, Xin, et al.
Pubblicazione: (2025)
JoyVASA: Portrait and Animal Image Animation with Diffusion-Based Audio-Driven Facial Dynamics and Head Motion Generation
di: Cao, Xuyang, et al.
Pubblicazione: (2024)
di: Cao, Xuyang, et al.
Pubblicazione: (2024)
CSTalk: Correlation Supervised Speech-driven 3D Emotional Facial Animation Generation
di: Liang, Xiangyu, et al.
Pubblicazione: (2024)
di: Liang, Xiangyu, et al.
Pubblicazione: (2024)
GaussianTalker: Real-Time High-Fidelity Talking Head Synthesis with Audio-Driven 3D Gaussian Splatting
di: Cho, Kyusun, et al.
Pubblicazione: (2024)
di: Cho, Kyusun, et al.
Pubblicazione: (2024)
Scaling Up Audio-Synchronized Visual Animation: An Efficient Training Paradigm
di: Zhang, Lin, et al.
Pubblicazione: (2025)
di: Zhang, Lin, et al.
Pubblicazione: (2025)
Exploiting Temporal Audio-Visual Correlation Embedding for Audio-Driven One-Shot Talking Head Animation
di: Xu, Zhihua, et al.
Pubblicazione: (2025)
di: Xu, Zhihua, et al.
Pubblicazione: (2025)
UniLS: End-to-End Audio-Driven Avatars for Unified Listening and Speaking
di: Chu, Xuangeng, et al.
Pubblicazione: (2025)
di: Chu, Xuangeng, et al.
Pubblicazione: (2025)
DiffPoseTalk: Speech-Driven Stylistic 3D Facial Animation and Head Pose Generation via Diffusion Models
di: Sun, Zhiyao, et al.
Pubblicazione: (2023)
di: Sun, Zhiyao, et al.
Pubblicazione: (2023)
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
di: Wang, Xiang, et al.
Pubblicazione: (2025)
di: Wang, Xiang, et al.
Pubblicazione: (2025)
KeyFace: Expressive Audio-Driven Facial Animation for Long Sequences via KeyFrame Interpolation
di: Bigata, Antoni, et al.
Pubblicazione: (2025)
di: Bigata, Antoni, et al.
Pubblicazione: (2025)
EmoFace: Emotion-Content Disentangled Speech-Driven 3D Talking Face Animation
di: Lin, Yihong, et al.
Pubblicazione: (2024)
di: Lin, Yihong, et al.
Pubblicazione: (2024)
OmniHuman-1: Rethinking the Scaling-Up of One-Stage Conditioned Human Animation Models
di: Lin, Gaojie, et al.
Pubblicazione: (2025)
di: Lin, Gaojie, et al.
Pubblicazione: (2025)
Polyglot: Multilingual Style Preserving Speech-Driven Facial Animation
di: Nocentini, Federico, et al.
Pubblicazione: (2026)
di: Nocentini, Federico, et al.
Pubblicazione: (2026)
Diverse Code Query Learning for Speech-Driven Facial Animation
di: Gu, Chunzhi, et al.
Pubblicazione: (2024)
di: Gu, Chunzhi, et al.
Pubblicazione: (2024)
AlignHuman: Improving Motion and Fidelity via Timestep-Segment Preference Optimization for Audio-Driven Human Animation
di: Liang, Chao, et al.
Pubblicazione: (2025)
di: Liang, Chao, et al.
Pubblicazione: (2025)
Controllable Expressive 3D Facial Animation via Diffusion in a Unified Multimodal Space
di: Liu, Kangwei, et al.
Pubblicazione: (2025)
di: Liu, Kangwei, et al.
Pubblicazione: (2025)
EmoFace: Audio-driven Emotional 3D Face Animation
di: Liu, Chang, et al.
Pubblicazione: (2024)
di: Liu, Chang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
StreamingTalker: Audio-driven 3D Facial Animation with Autoregressive Diffusion Model
di: Yang, Yifan, et al.
Pubblicazione: (2025) -
UniTalking: A Unified Audio-Video Framework for Talking Portrait Generation
di: Li, Hebeizi, et al.
Pubblicazione: (2026) -
GLDiTalker: Speech-Driven 3D Facial Animation with Graph Latent Diffusion Transformer
di: Lin, Yihong, et al.
Pubblicazione: (2024) -
MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization
di: Kim, Hyung Kyu, et al.
Pubblicazione: (2025) -
PC-Talk: Precise Facial Animation Control for Audio-Driven Talking Face Generation
di: Wang, Baiqin, et al.
Pubblicazione: (2025)