EmoDiffusion: Enhancing Emotional 3D Facial Animation with Latent Diffusion Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Yixuan, Chang, Qing, Wang, Yuxi, Chen, Guang, Zhang, Zhaoxiang, Peng, Junran |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
OOD-HOI: Text-Driven 3D Whole-Body Human-Object Interactions Generation Beyond Training Domains
par: Zhang, Yixuan, et autres
Publié: (2024)
par: Zhang, Yixuan, et autres
Publié: (2024)
DiffSpeaker: Speech-Driven 3D Facial Animation with Diffusion Transformer
par: Ma, Zhiyuan, et autres
Publié: (2024)
par: Ma, Zhiyuan, et autres
Publié: (2024)
EmoFace: Audio-driven Emotional 3D Face Animation
par: Liu, Chang, et autres
Publié: (2024)
par: Liu, Chang, et autres
Publié: (2024)
SAGD: Boundary-Enhanced Segment Anything in 3D Gaussian via Gaussian Decomposition
par: Hu, Xu, et autres
Publié: (2024)
par: Hu, Xu, et autres
Publié: (2024)
GLDiTalker: Speech-Driven 3D Facial Animation with Graph Latent Diffusion Transformer
par: Lin, Yihong, et autres
Publié: (2024)
par: Lin, Yihong, et autres
Publié: (2024)
EmoAttack: Emotion-to-Image Diffusion Models for Emotional Backdoor Generation
par: Wei, Tianyu, et autres
Publié: (2024)
par: Wei, Tianyu, et autres
Publié: (2024)
StableMoFusion: Towards Robust and Efficient Diffusion-based Motion Generation Framework
par: Huang, Yiheng, et autres
Publié: (2024)
par: Huang, Yiheng, et autres
Publié: (2024)
Seek for Incantations: Towards Accurate Text-to-Image Diffusion Synthesis through Prompt Engineering
par: Yu, Chang, et autres
Publié: (2024)
par: Yu, Chang, et autres
Publié: (2024)
EditEmoTalk: Controllable Speech-Driven 3D Facial Animation with Continuous Expression Editing
par: Jiang, Diqiong, et autres
Publié: (2026)
par: Jiang, Diqiong, et autres
Publié: (2026)
StreamingTalker: Audio-driven 3D Facial Animation with Autoregressive Diffusion Model
par: Yang, Yifan, et autres
Publié: (2025)
par: Yang, Yifan, et autres
Publié: (2025)
FurniScene: A Large-scale 3D Room Dataset with Intricate Furnishing Scenes
par: Zhang, Genghao, et autres
Publié: (2024)
par: Zhang, Genghao, et autres
Publié: (2024)
Emotional Speech-driven 3D Body Animation via Disentangled Latent Diffusion
par: Chhatre, Kiran, et autres
Publié: (2023)
par: Chhatre, Kiran, et autres
Publié: (2023)
NeoVerse: Enhancing 4D World Model with in-the-wild Monocular Videos
par: Yang, Yuxue, et autres
Publié: (2026)
par: Yang, Yuxue, et autres
Publié: (2026)
EmoFace: Emotion-Content Disentangled Speech-Driven 3D Talking Face Animation
par: Lin, Yihong, et autres
Publié: (2024)
par: Lin, Yihong, et autres
Publié: (2024)
MaterialSeg3D: Segmenting Dense Materials from 2D Priors for 3D Assets
par: Li, Zeyu, et autres
Publié: (2024)
par: Li, Zeyu, et autres
Publié: (2024)
EmoDiffTalk:Emotion-aware Diffusion for Editable 3D Gaussian Talking Head
par: Liu, Chang, et autres
Publié: (2025)
par: Liu, Chang, et autres
Publié: (2025)
AnimateMe: 4D Facial Expressions via Diffusion Models
par: Gerogiannis, Dimitrios, et autres
Publié: (2024)
par: Gerogiannis, Dimitrios, et autres
Publié: (2024)
CityX: Controllable Procedural Content Generation for Unbounded 3D Cities
par: Zhang, Shougao, et autres
Publié: (2024)
par: Zhang, Shougao, et autres
Publié: (2024)
EmoTalker: Emotionally Editable Talking Face Generation via Diffusion Model
par: Zhang, Bingyuan, et autres
Publié: (2024)
par: Zhang, Bingyuan, et autres
Publié: (2024)
MEDTalk: Multimodal Controlled 3D Facial Animation with Dynamic Emotions by Disentangled Embedding
par: Liu, Chang, et autres
Publié: (2025)
par: Liu, Chang, et autres
Publié: (2025)
Animate3D: Animating Any 3D Model with Multi-view Video Diffusion
par: Jiang, Yanqin, et autres
Publié: (2024)
par: Jiang, Yanqin, et autres
Publié: (2024)
EmoGen: Emotional Image Content Generation with Text-to-Image Diffusion Models
par: Yang, Jingyuan, et autres
Publié: (2024)
par: Yang, Jingyuan, et autres
Publié: (2024)
EmoLat: Text-driven Image Sentiment Transfer via Emotion Latent Space
par: Zhang, Jing, et autres
Publié: (2026)
par: Zhang, Jing, et autres
Publié: (2026)
GSPlane: Concise and Accurate Planar Reconstruction via Structured Representation
par: Gan, Ruitong, et autres
Publié: (2025)
par: Gan, Ruitong, et autres
Publié: (2025)
SEDTalker: Emotion-Aware 3D Facial Animation Using Frame-Level Speech Emotion Diarization
par: Jafari, Farzaneh, et autres
Publié: (2026)
par: Jafari, Farzaneh, et autres
Publié: (2026)
LayerAnimate: Layer-level Control for Animation
par: Yang, Yuxue, et autres
Publié: (2025)
par: Yang, Yuxue, et autres
Publié: (2025)
Compositional Inversion for Stable Diffusion Models
par: Zhang, Xulu, et autres
Publié: (2023)
par: Zhang, Xulu, et autres
Publié: (2023)
UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation
par: Wang, Xiang, et autres
Publié: (2024)
par: Wang, Xiang, et autres
Publié: (2024)
CityGaussianV2: Efficient and Geometrically Accurate Reconstruction for Large-Scale Scenes
par: Liu, Yang, et autres
Publié: (2024)
par: Liu, Yang, et autres
Publié: (2024)
VGGT-X: When VGGT Meets Dense Novel View Synthesis
par: Liu, Yang, et autres
Publié: (2025)
par: Liu, Yang, et autres
Publié: (2025)
RoomCraft: Controllable and Complete 3D Indoor Scene Generation
par: Zhou, Mengqi, et autres
Publié: (2025)
par: Zhou, Mengqi, et autres
Publié: (2025)
CSTalk: Correlation Supervised Speech-driven 3D Emotional Facial Animation Generation
par: Liang, Xiangyu, et autres
Publié: (2024)
par: Liang, Xiangyu, et autres
Publié: (2024)
SceneX: Procedural Controllable Large-scale Scene Generation
par: Zhou, Mengqi, et autres
Publié: (2024)
par: Zhou, Mengqi, et autres
Publié: (2024)
HLG: Comprehensive 3D Room Construction via Hierarchical Layout Generation
par: Wang, Xiping, et autres
Publié: (2025)
par: Wang, Xiping, et autres
Publié: (2025)
ReactDiff: Latent Diffusion for Facial Reaction Generation
par: Li, Jiaming, et autres
Publié: (2025)
par: Li, Jiaming, et autres
Publié: (2025)
Enhancing Facial Privacy Protection via Weakening Diffusion Purification
par: Salar, Ali, et autres
Publié: (2025)
par: Salar, Ali, et autres
Publié: (2025)
A Curriculum-style Self-training Approach for Source-Free Semantic Segmentation
par: Wang, Yuxi, et autres
Publié: (2021)
par: Wang, Yuxi, et autres
Publié: (2021)
ESGaussianFace: Emotional and Stylized Audio-Driven Facial Animation via 3D Gaussian Splatting
par: Ma, Chuhang, et autres
Publié: (2026)
par: Ma, Chuhang, et autres
Publié: (2026)
Knot Forcing: Taming Autoregressive Video Diffusion Models for Real-time Infinite Interactive Portrait Animation
par: Xiao, Steven, et autres
Publié: (2025)
par: Xiao, Steven, et autres
Publié: (2025)
Enhancing Sound Source Localization via False Negative Elimination
par: Song, Zengjie, et autres
Publié: (2024)
par: Song, Zengjie, et autres
Publié: (2024)
Documents similaires
-
OOD-HOI: Text-Driven 3D Whole-Body Human-Object Interactions Generation Beyond Training Domains
par: Zhang, Yixuan, et autres
Publié: (2024) -
DiffSpeaker: Speech-Driven 3D Facial Animation with Diffusion Transformer
par: Ma, Zhiyuan, et autres
Publié: (2024) -
EmoFace: Audio-driven Emotional 3D Face Animation
par: Liu, Chang, et autres
Publié: (2024) -
SAGD: Boundary-Enhanced Segment Anything in 3D Gaussian via Gaussian Decomposition
par: Hu, Xu, et autres
Publié: (2024) -
GLDiTalker: Speech-Driven 3D Facial Animation with Graph Latent Diffusion Transformer
par: Lin, Yihong, et autres
Publié: (2024)