JambaTalk: Speech-Driven 3D Talking Head Generation Based on Hybrid Transformer-Mamba Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Jafari, Farzaneh, Berretti, Stefano, Basu, Anup |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SEDTalker: Emotion-Aware 3D Facial Animation Using Frame-Level Speech Emotion Diarization
di: Jafari, Farzaneh, et al.
Pubblicazione: (2026)
di: Jafari, Farzaneh, et al.
Pubblicazione: (2026)
EmoVOCA: Speech-Driven Emotional 3D Talking Heads
di: Nocentini, Federico, et al.
Pubblicazione: (2024)
di: Nocentini, Federico, et al.
Pubblicazione: (2024)
FreeTalk: Emotional Topology-Free 3D Talking Heads
di: Nocentini, Federico, et al.
Pubblicazione: (2026)
di: Nocentini, Federico, et al.
Pubblicazione: (2026)
ScanTalk: 3D Talking Heads from Unregistered Scans
di: Nocentini, Federico, et al.
Pubblicazione: (2024)
di: Nocentini, Federico, et al.
Pubblicazione: (2024)
Beyond Fixed Topologies: Unregistered Training and Comprehensive Evaluation Metrics for 3D Talking Heads
di: Nocentini, Federico, et al.
Pubblicazione: (2024)
di: Nocentini, Federico, et al.
Pubblicazione: (2024)
GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
di: Agarwal, Madhav, et al.
Pubblicazione: (2025)
di: Agarwal, Madhav, et al.
Pubblicazione: (2025)
CapTalk: Text-Guided Stylization and Speech-Driven 3D Head Animation
di: Chu, Xuangeng, et al.
Pubblicazione: (2026)
di: Chu, Xuangeng, et al.
Pubblicazione: (2026)
OT-Talk: Animating 3D Talking Head with Optimal Transportation
di: Wang, Xinmu, et al.
Pubblicazione: (2025)
di: Wang, Xinmu, et al.
Pubblicazione: (2025)
DiffPoseTalk: Speech-Driven Stylistic 3D Facial Animation and Head Pose Generation via Diffusion Models
di: Sun, Zhiyao, et al.
Pubblicazione: (2023)
di: Sun, Zhiyao, et al.
Pubblicazione: (2023)
PTalker: Personalized Speech-Driven 3D Talking Head Animation via Style Disentanglement and Modality Alignment
di: Wang, Bin, et al.
Pubblicazione: (2025)
di: Wang, Bin, et al.
Pubblicazione: (2025)
DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
MultiTalk: Enhancing 3D Talking Head Generation Across Languages with Multilingual Video Dataset
di: Sung-Bin, Kim, et al.
Pubblicazione: (2024)
di: Sung-Bin, Kim, et al.
Pubblicazione: (2024)
TalkingGaussian: Structure-Persistent 3D Talking Head Synthesis via Gaussian Splatting
di: Li, Jiahe, et al.
Pubblicazione: (2024)
di: Li, Jiahe, et al.
Pubblicazione: (2024)
EmoDiffTalk:Emotion-aware Diffusion for Editable 3D Gaussian Talking Head
di: Liu, Chang, et al.
Pubblicazione: (2025)
di: Liu, Chang, et al.
Pubblicazione: (2025)
EmoTalk3D: High-Fidelity Free-View Synthesis of Emotional 3D Talking Head
di: He, Qianyun, et al.
Pubblicazione: (2024)
di: He, Qianyun, et al.
Pubblicazione: (2024)
SyncTalk: The Devil is in the Synchronization for Talking Head Synthesis
di: Peng, Ziqiao, et al.
Pubblicazione: (2023)
di: Peng, Ziqiao, et al.
Pubblicazione: (2023)
TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
Talking Head Generation Driven by Speech-Related Facial Action Units and Audio- Based on Multimodal Representation Fusion
di: Chen, Sen, et al.
Pubblicazione: (2022)
di: Chen, Sen, et al.
Pubblicazione: (2022)
TalkVid: A Large-Scale Diversified Dataset for Audio-Driven Talking Head Synthesis
di: Chen, Shunian, et al.
Pubblicazione: (2025)
di: Chen, Shunian, et al.
Pubblicazione: (2025)
EmbedTalk: Triplane-Free Talking Head Synthesis using Embedding-Driven Gaussian Deformation
di: Saggar, Arpita, et al.
Pubblicazione: (2026)
di: Saggar, Arpita, et al.
Pubblicazione: (2026)
FD2Talk: Towards Generalized Talking Head Generation with Facial Decoupled Diffusion Model
di: Yao, Ziyu, et al.
Pubblicazione: (2024)
di: Yao, Ziyu, et al.
Pubblicazione: (2024)
TalkingEyes: Pluralistic Speech-Driven 3D Eye Gaze Animation
di: Zhuang, Yixiang, et al.
Pubblicazione: (2025)
di: Zhuang, Yixiang, et al.
Pubblicazione: (2025)
S^3D-NeRF: Single-Shot Speech-Driven Neural Radiance Field for High Fidelity Talking Head Synthesis
di: Li, Dongze, et al.
Pubblicazione: (2024)
di: Li, Dongze, et al.
Pubblicazione: (2024)
Toward Fine-Grained Facial Control in 3D Talking Head Generation
di: Xie, Shaoyang, et al.
Pubblicazione: (2026)
di: Xie, Shaoyang, et al.
Pubblicazione: (2026)
SPEAK: Speech-Driven Pose and Emotion-Adjustable Talking Head Generation
di: Cai, Changpeng, et al.
Pubblicazione: (2024)
di: Cai, Changpeng, et al.
Pubblicazione: (2024)
NeRFFaceSpeech: One-shot Audio-driven 3D Talking Head Synthesis via Generative Prior
di: Kim, Gihoon, et al.
Pubblicazione: (2024)
di: Kim, Gihoon, et al.
Pubblicazione: (2024)
EmoTalkingGaussian: Continuous Emotion-conditioned Talking Head Synthesis
di: Cha, Junuk, et al.
Pubblicazione: (2025)
di: Cha, Junuk, et al.
Pubblicazione: (2025)
FixTalk: Taming Identity Leakage for High-Quality Talking Head Generation in Extreme Cases
di: Tan, Shuai, et al.
Pubblicazione: (2025)
di: Tan, Shuai, et al.
Pubblicazione: (2025)
ConsistTalk: Intensity Controllable Temporally Consistent Talking Head Generation with Diffusion Noise Search
di: Liu, Zhenjie, et al.
Pubblicazione: (2025)
di: Liu, Zhenjie, et al.
Pubblicazione: (2025)
MoCoTalk: Multi-Conditional Diffusion with Adaptive Router for Controllable Talking Head Generation
di: Ye, Xinyan, et al.
Pubblicazione: (2026)
di: Ye, Xinyan, et al.
Pubblicazione: (2026)
MoDiT: Learning Highly Consistent 3D Motion Coefficients with Diffusion Transformer for Talking Head Generation
di: Wang, Yucheng, et al.
Pubblicazione: (2025)
di: Wang, Yucheng, et al.
Pubblicazione: (2025)
Perceptually Accurate 3D Talking Head Generation: New Definitions, Speech-Mesh Representation, and Evaluation Metrics
di: Chae-Yeon, Lee, et al.
Pubblicazione: (2025)
di: Chae-Yeon, Lee, et al.
Pubblicazione: (2025)
Learning Online Scale Transformation for Talking Head Video Generation
di: Hong, Fa-Ting, et al.
Pubblicazione: (2024)
di: Hong, Fa-Ting, et al.
Pubblicazione: (2024)
HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis
di: Liu, Shiyu, et al.
Pubblicazione: (2025)
di: Liu, Shiyu, et al.
Pubblicazione: (2025)
TalkingHeadBench: A Multi-Modal Benchmark & Analysis of Talking-Head DeepFake Detection
di: Xiong, Xinqi, et al.
Pubblicazione: (2025)
di: Xiong, Xinqi, et al.
Pubblicazione: (2025)
StyleTalk++: A Unified Framework for Controlling the Speaking Styles of Talking Heads
di: Wang, Suzhen, et al.
Pubblicazione: (2024)
di: Wang, Suzhen, et al.
Pubblicazione: (2024)
DualTalk: Dual-Speaker Interaction for 3D Talking Head Conversations
di: Peng, Ziqiao, et al.
Pubblicazione: (2025)
di: Peng, Ziqiao, et al.
Pubblicazione: (2025)
Splat-Portrait: Generalizing Talking Heads with Gaussian Splatting
di: Shi, Tong, et al.
Pubblicazione: (2026)
di: Shi, Tong, et al.
Pubblicazione: (2026)
THEval. Evaluation Framework for Talking Head Video Generation
di: Quignon, Nabyl, et al.
Pubblicazione: (2025)
di: Quignon, Nabyl, et al.
Pubblicazione: (2025)
DiffusionTalker: Efficient and Compact Speech-Driven 3D Talking Head via Personalizer-Guided Distillation
di: Chen, Peng, et al.
Pubblicazione: (2025)
di: Chen, Peng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SEDTalker: Emotion-Aware 3D Facial Animation Using Frame-Level Speech Emotion Diarization
di: Jafari, Farzaneh, et al.
Pubblicazione: (2026) -
EmoVOCA: Speech-Driven Emotional 3D Talking Heads
di: Nocentini, Federico, et al.
Pubblicazione: (2024) -
FreeTalk: Emotional Topology-Free 3D Talking Heads
di: Nocentini, Federico, et al.
Pubblicazione: (2026) -
ScanTalk: 3D Talking Heads from Unregistered Scans
di: Nocentini, Federico, et al.
Pubblicazione: (2024) -
Beyond Fixed Topologies: Unregistered Training and Comprehensive Evaluation Metrics for 3D Talking Heads
di: Nocentini, Federico, et al.
Pubblicazione: (2024)