DEEPTalk: Dynamic Emotion Embedding for Probabilistic Speech-Driven 3D Face Animation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Jisoo, Cho, Jungbin, Park, Joonho, Hwang, Soonmin, Kim, Da Eun, Kim, Geon, Yu, Youngjae |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EgoSpeak: Learning When to Speak for Egocentric Conversational Agents in the Wild
par: Kim, Junhyeok, et autres
Publié: (2025)
par: Kim, Junhyeok, et autres
Publié: (2025)
DisCoRD: Discrete Tokens to Continuous Motion via Rectified Flow Decoding
par: Cho, Jungbin, et autres
Publié: (2024)
par: Cho, Jungbin, et autres
Publié: (2024)
SceneAdapt: Scene-aware Adaptation of Human Motion Diffusion
par: Cho, Jungbin, et autres
Publié: (2025)
par: Cho, Jungbin, et autres
Publié: (2025)
EmoFace: Emotion-Content Disentangled Speech-Driven 3D Talking Face Animation
par: Lin, Yihong, et autres
Publié: (2024)
par: Lin, Yihong, et autres
Publié: (2024)
V.I.P. : Iterative Online Preference Distillation for Efficient Video Diffusion Models
par: Kim, Jisoo, et autres
Publié: (2025)
par: Kim, Jisoo, et autres
Publié: (2025)
Learning Phonetic Context-Dependent Viseme for Enhancing Speech-Driven 3D Facial Animation
par: Kim, Hyung Kyu, et autres
Publié: (2025)
par: Kim, Hyung Kyu, et autres
Publié: (2025)
MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization
par: Kim, Hyung Kyu, et autres
Publié: (2025)
par: Kim, Hyung Kyu, et autres
Publié: (2025)
Pri4R: Learning World Dynamics for Vision-Language-Action Models with Privileged 4D Representation
par: Kim, Jisoo, et autres
Publié: (2026)
par: Kim, Jisoo, et autres
Publié: (2026)
Lightweight Wasserstein Audio-Visual Model for Unified Speech Enhancement and Separation
par: Park, Jisoo, et autres
Publié: (2025)
par: Park, Jisoo, et autres
Publié: (2025)
Enhancing Speech-Driven 3D Facial Animation with Audio-Visual Guidance from Lip Reading Expert
par: EunGi, Han, et autres
Publié: (2024)
par: EunGi, Han, et autres
Publié: (2024)
EmoFace: Audio-driven Emotional 3D Face Animation
par: Liu, Chang, et autres
Publié: (2024)
par: Liu, Chang, et autres
Publié: (2024)
KMTalk: Speech-Driven 3D Facial Animation with Key Motion Embedding
par: Xu, Zhihao, et autres
Publié: (2024)
par: Xu, Zhihao, et autres
Publié: (2024)
Dr. Splat: Directly Referring 3D Gaussian Splatting via Direct Language Embedding Registration
par: Jun-Seong, Kim, et autres
Publié: (2025)
par: Jun-Seong, Kim, et autres
Publié: (2025)
SAiD: Speech-driven Blendshape Facial Animation with Diffusion
par: Park, Inkyu, et autres
Publié: (2023)
par: Park, Inkyu, et autres
Publié: (2023)
Learning Disentangled Speech- and Expression-Driven Blendshapes for 3D Talking Face Animation
par: Mao, Yuxiang, et autres
Publié: (2025)
par: Mao, Yuxiang, et autres
Publié: (2025)
ParaHome: Parameterizing Everyday Home Activities Towards 3D Generative Modeling of Human-Object Interactions
par: Kim, Jeonghwan, et autres
Publié: (2024)
par: Kim, Jeonghwan, et autres
Publié: (2024)
ESGaussianFace: Emotional and Stylized Audio-Driven Facial Animation via 3D Gaussian Splatting
par: Ma, Chuhang, et autres
Publié: (2026)
par: Ma, Chuhang, et autres
Publié: (2026)
Speaking Beyond Language: A Large-Scale Multimodal Dataset for Learning Nonverbal Cues from Video-Grounded Dialogues
par: Kim, Youngmin, et autres
Publié: (2025)
par: Kim, Youngmin, et autres
Publié: (2025)
Boosting Cross-spectral Unsupervised Domain Adaptation for Thermal Semantic Segmentation
par: Kwon, Seokjun, et autres
Publié: (2025)
par: Kwon, Seokjun, et autres
Publié: (2025)
MEDTalk: Multimodal Controlled 3D Facial Animation with Dynamic Emotions by Disentangled Embedding
par: Liu, Chang, et autres
Publié: (2025)
par: Liu, Chang, et autres
Publié: (2025)
Reasoning About Traversability: Language-Guided Off-Road 3D Trajectory Planning
par: Park, Byounggun, et autres
Publié: (2026)
par: Park, Byounggun, et autres
Publié: (2026)
AVIN-Chat: An Audio-Visual Interactive Chatbot System with Emotional State Tuning
par: Park, Chanhyuk, et autres
Publié: (2024)
par: Park, Chanhyuk, et autres
Publié: (2024)
PointCubeNet: 3D Part-level Reasoning with 3x3x3 Point Cloud Blocks
par: Kim, Da-Yeong, et autres
Publié: (2025)
par: Kim, Da-Yeong, et autres
Publié: (2025)
Hierarchically Structured Neural Bones for Reconstructing Animatable Objects from Casual Videos
par: Jeon, Subin, et autres
Publié: (2024)
par: Jeon, Subin, et autres
Publié: (2024)
Polyglot: Multilingual Style Preserving Speech-Driven Facial Animation
par: Nocentini, Federico, et autres
Publié: (2026)
par: Nocentini, Federico, et autres
Publié: (2026)
Joint-Embedding Predictive Architecture for Self-Supervised Learning of Mask Classification Architecture
par: Kim, Dong-Hee, et autres
Publié: (2024)
par: Kim, Dong-Hee, et autres
Publié: (2024)
Polarimetric BSSRDF Acquisition of Dynamic Faces
par: Ha, Hyunho, et autres
Publié: (2024)
par: Ha, Hyunho, et autres
Publié: (2024)
FPRF: Feed-Forward Photorealistic Style Transfer of Large-Scale 3D Neural Radiance Fields
par: Kim, GeonU, et autres
Publié: (2024)
par: Kim, GeonU, et autres
Publié: (2024)
A Proof of the Exact Convergence Rate of Gradient Descent
par: Kim, Jungbin
Publié: (2024)
par: Kim, Jungbin
Publié: (2024)
A Proof of Exact Convergence Rate of Gradient Descent. Part I. Performance Criterion $\Vert \nabla f(x_N)\Vert^2/(f(x_0)-f_*)$
par: Kim, Jungbin
Publié: (2024)
par: Kim, Jungbin
Publié: (2024)
Cross-Modal Emotion Transfer for Emotion Editing in Talking Face Video
par: Choi, Chanhyuk, et autres
Publié: (2026)
par: Choi, Chanhyuk, et autres
Publié: (2026)
Background-Aware Defect Generation for Robust Industrial Anomaly Detection
par: Cho, Youngjae, et autres
Publié: (2024)
par: Cho, Youngjae, et autres
Publié: (2024)
D2E: Scaling Vision-Action Pretraining on Desktop Data for Transfer to Embodied AI
par: Choi, Suhwan, et autres
Publié: (2025)
par: Choi, Suhwan, et autres
Publié: (2025)
SEDTalker: Emotion-Aware 3D Facial Animation Using Frame-Level Speech Emotion Diarization
par: Jafari, Farzaneh, et autres
Publié: (2026)
par: Jafari, Farzaneh, et autres
Publié: (2026)
AudioFace: Language-Assisted Speech-Driven Facial Animation with Multimodal Language Models
par: Zheng, Kai, et autres
Publié: (2026)
par: Zheng, Kai, et autres
Publié: (2026)
Group3D: MLLM-Driven Semantic Grouping for Open-Vocabulary 3D Object Detection
par: Kim, Youbin, et autres
Publié: (2026)
par: Kim, Youbin, et autres
Publié: (2026)
Emotional Speech-driven 3D Body Animation via Disentangled Latent Diffusion
par: Chhatre, Kiran, et autres
Publié: (2023)
par: Chhatre, Kiran, et autres
Publié: (2023)
VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding
par: Kim, Kangsan, et autres
Publié: (2024)
par: Kim, Kangsan, et autres
Publié: (2024)
ProbTalk3D: Non-Deterministic Emotion Controllable Speech-Driven 3D Facial Animation Synthesis Using VQ-VAE
par: Wu, Sichun, et autres
Publié: (2024)
par: Wu, Sichun, et autres
Publié: (2024)
CSTalk: Correlation Supervised Speech-driven 3D Emotional Facial Animation Generation
par: Liang, Xiangyu, et autres
Publié: (2024)
par: Liang, Xiangyu, et autres
Publié: (2024)
Documents similaires
-
EgoSpeak: Learning When to Speak for Egocentric Conversational Agents in the Wild
par: Kim, Junhyeok, et autres
Publié: (2025) -
DisCoRD: Discrete Tokens to Continuous Motion via Rectified Flow Decoding
par: Cho, Jungbin, et autres
Publié: (2024) -
SceneAdapt: Scene-aware Adaptation of Human Motion Diffusion
par: Cho, Jungbin, et autres
Publié: (2025) -
EmoFace: Emotion-Content Disentangled Speech-Driven 3D Talking Face Animation
par: Lin, Yihong, et autres
Publié: (2024) -
V.I.P. : Iterative Online Preference Distillation for Efficient Video Diffusion Models
par: Kim, Jisoo, et autres
Publié: (2025)