ARTalk: Speech-Driven 3D Head Animation via Autoregressive Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chu, Xuangeng, Goswami, Nabarun, Cui, Ziteng, Wang, Hanqin, Harada, Tatsuya |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CapTalk: Text-Guided Stylization and Speech-Driven 3D Head Animation
par: Chu, Xuangeng, et autres
Publié: (2026)
par: Chu, Xuangeng, et autres
Publié: (2026)
Generalizable and Animatable Gaussian Head Avatar
par: Chu, Xuangeng, et autres
Publié: (2024)
par: Chu, Xuangeng, et autres
Publié: (2024)
Luminance-GS: Adapting 3D Gaussian Splatting to Challenging Lighting Conditions with View-Adaptive Curve Adjustment
par: Cui, Ziteng, et autres
Publié: (2025)
par: Cui, Ziteng, et autres
Publié: (2025)
I2-NeRF: Learning Neural Radiance Fields Under Physically-Grounded Media Interactions
par: Liu, Shuhong, et autres
Publié: (2025)
par: Liu, Shuhong, et autres
Publié: (2025)
RAWild: Sensor-Agnostic RAW Object Detection via Physics-Guided Curve and Grid Modeling
par: Liu, Shuhong, et autres
Publié: (2026)
par: Liu, Shuhong, et autres
Publié: (2026)
Unifying Color and Lightness Correction with View-Adaptive Curve Adjustment for Robust 3D Novel View Synthesis
par: Cui, Ziteng, et autres
Publié: (2026)
par: Cui, Ziteng, et autres
Publié: (2026)
RAW-Adapter: Adapting Pre-trained Visual Model to Camera RAW Images
par: Cui, Ziteng, et autres
Publié: (2024)
par: Cui, Ziteng, et autres
Publié: (2024)
RAW-Adapter: Adapting Pre-trained Visual Model to Camera RAW Images and A Benchmark
par: Cui, Ziteng, et autres
Publié: (2025)
par: Cui, Ziteng, et autres
Publié: (2025)
GPAvatar: Generalizable and Precise Head Avatar from Image(s)
par: Chu, Xuangeng, et autres
Publié: (2024)
par: Chu, Xuangeng, et autres
Publié: (2024)
Discovering an Image-Adaptive Coordinate System for Photography Processing
par: Cui, Ziteng, et autres
Publié: (2025)
par: Cui, Ziteng, et autres
Publié: (2025)
D-AR: Diffusion via Autoregressive Models
par: Gao, Ziteng, et autres
Publié: (2025)
par: Gao, Ziteng, et autres
Publié: (2025)
PTalker: Personalized Speech-Driven 3D Talking Head Animation via Style Disentanglement and Modality Alignment
par: Wang, Bin, et autres
Publié: (2025)
par: Wang, Bin, et autres
Publié: (2025)
FluxFlow: Conservative Flow-Matching for Astronomical Image Super-Resolution
par: Liu, Shuhong, et autres
Publié: (2026)
par: Liu, Shuhong, et autres
Publié: (2026)
Emergence of Painting Ability via Recognition-Driven Evolution
par: Lin, Yi, et autres
Publié: (2025)
par: Lin, Yi, et autres
Publié: (2025)
RealX3D: A Physically-Degraded 3D Benchmark for Multi-view Visual Restoration and Reconstruction
par: Liu, Shuhong, et autres
Publié: (2025)
par: Liu, Shuhong, et autres
Publié: (2025)
Advancing Large Multi-modal Models with Explicit Chain-of-Reasoning and Visual Question Generation
par: Uehara, Kohei, et autres
Publié: (2024)
par: Uehara, Kohei, et autres
Publié: (2024)
DiffPoseTalk: Speech-Driven Stylistic 3D Facial Animation and Head Pose Generation via Diffusion Models
par: Sun, Zhiyao, et autres
Publié: (2023)
par: Sun, Zhiyao, et autres
Publié: (2023)
FluentAvatar: Flicker-Free Talking-Head Animation via Phoneme-Guided Autoregressive Modeling
par: Deng, Yuchen, et autres
Publié: (2025)
par: Deng, Yuchen, et autres
Publié: (2025)
Denoising the Deep Sky: Physics-Based CCD Noise Formation for Astronomical Imaging
par: Liu, Shuhong, et autres
Publié: (2026)
par: Liu, Shuhong, et autres
Publié: (2026)
Personalizing Causal Audio-Driven Facial Motion via Dynamic Multi-modal Retrieval
par: Chu, Xuangeng, et autres
Publié: (2026)
par: Chu, Xuangeng, et autres
Publié: (2026)
AdaMesh: Personalized Facial Expressions and Head Poses for Adaptive Speech-Driven 3D Facial Animation
par: Chen, Liyang, et autres
Publié: (2023)
par: Chen, Liyang, et autres
Publié: (2023)
Aleth-NeRF: Low-light Condition View Synthesis with Concealing Fields
par: Cui, Ziteng, et autres
Publié: (2023)
par: Cui, Ziteng, et autres
Publié: (2023)
Aleth-NeRF: Illumination Adaptive NeRF with Concealing Field Assumption
par: Cui, Ziteng, et autres
Publié: (2023)
par: Cui, Ziteng, et autres
Publié: (2023)
MaGRITTe: Manipulative and Generative 3D Realization from Image, Topview and Text
par: Hara, Takayuki, et autres
Publié: (2024)
par: Hara, Takayuki, et autres
Publié: (2024)
HeadGaS: Real-Time Animatable Head Avatars via 3D Gaussian Splatting
par: Dhamo, Helisa, et autres
Publié: (2023)
par: Dhamo, Helisa, et autres
Publié: (2023)
Video-Driven Animation of Neural Head Avatars
par: Paier, Wolfgang, et autres
Publié: (2024)
par: Paier, Wolfgang, et autres
Publié: (2024)
TalkingEyes: Pluralistic Speech-Driven 3D Eye Gaze Animation
par: Zhuang, Yixiang, et autres
Publié: (2025)
par: Zhuang, Yixiang, et autres
Publié: (2025)
KMTalk: Speech-Driven 3D Facial Animation with Key Motion Embedding
par: Xu, Zhihao, et autres
Publié: (2024)
par: Xu, Zhihao, et autres
Publié: (2024)
HeadStudio: Text to Animatable Head Avatars with 3D Gaussian Splatting
par: Zhou, Zhenglin, et autres
Publié: (2024)
par: Zhou, Zhenglin, et autres
Publié: (2024)
LSF-Animation: Label-Free Speech-Driven Facial Animation via Implicit Feature Representation
par: Lu, Xin, et autres
Publié: (2025)
par: Lu, Xin, et autres
Publié: (2025)
StreamingTalker: Audio-driven 3D Facial Animation with Autoregressive Diffusion Model
par: Yang, Yifan, et autres
Publié: (2025)
par: Yang, Yifan, et autres
Publié: (2025)
DEEPTalk: Dynamic Emotion Embedding for Probabilistic Speech-Driven 3D Face Animation
par: Kim, Jisoo, et autres
Publié: (2024)
par: Kim, Jisoo, et autres
Publié: (2024)
Video Forgery Detection with Optical Flow Residuals and Spatial-Temporal Consistency
par: Xue, Xi, et autres
Publié: (2025)
par: Xue, Xi, et autres
Publié: (2025)
LottieGPT: Tokenizing Vector Animation for Autoregressive Generation
par: Chen, Junhao, et autres
Publié: (2026)
par: Chen, Junhao, et autres
Publié: (2026)
Improved 3D Scene Stylization via Text-Guided Generative Image Editing with Region-Based Control
par: Fujiwara, Haruo, et autres
Publié: (2025)
par: Fujiwara, Haruo, et autres
Publié: (2025)
EmoFace: Emotion-Content Disentangled Speech-Driven 3D Talking Face Animation
par: Lin, Yihong, et autres
Publié: (2024)
par: Lin, Yihong, et autres
Publié: (2024)
GLDiTalker: Speech-Driven 3D Facial Animation with Graph Latent Diffusion Transformer
par: Lin, Yihong, et autres
Publié: (2024)
par: Lin, Yihong, et autres
Publié: (2024)
EmoVOCA: Speech-Driven Emotional 3D Talking Heads
par: Nocentini, Federico, et autres
Publié: (2024)
par: Nocentini, Federico, et autres
Publié: (2024)
3D Gaussian Blendshapes for Head Avatar Animation
par: Ma, Shengjie, et autres
Publié: (2024)
par: Ma, Shengjie, et autres
Publié: (2024)
SyncAnimation: A Real-Time End-to-End Framework for Audio-Driven Human Pose and Talking Head Animation
par: Liu, Yujian, et autres
Publié: (2025)
par: Liu, Yujian, et autres
Publié: (2025)
Documents similaires
-
CapTalk: Text-Guided Stylization and Speech-Driven 3D Head Animation
par: Chu, Xuangeng, et autres
Publié: (2026) -
Generalizable and Animatable Gaussian Head Avatar
par: Chu, Xuangeng, et autres
Publié: (2024) -
Luminance-GS: Adapting 3D Gaussian Splatting to Challenging Lighting Conditions with View-Adaptive Curve Adjustment
par: Cui, Ziteng, et autres
Publié: (2025) -
I2-NeRF: Learning Neural Radiance Fields Under Physically-Grounded Media Interactions
par: Liu, Shuhong, et autres
Publié: (2025) -
RAWild: Sensor-Agnostic RAW Object Detection via Physics-Guided Curve and Grid Modeling
par: Liu, Shuhong, et autres
Publié: (2026)