VLOGGER: Multimodal Diffusion for Embodied Avatar Synthesis
Fuente:
arXiv
Saved in:
| Main Authors: | Corona, Enric, Zanfir, Andrei, Bazavan, Eduard Gabriel, Kolotouros, Nikos, Alldieck, Thiemo, Sminchisescu, Cristian |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Instant 3D Human Avatar Generation using Image Diffusion Models
by: Kolotouros, Nikos, et al.
Published: (2024)
by: Kolotouros, Nikos, et al.
Published: (2024)
DiffHuman: Probabilistic Photorealistic 3D Reconstruction of Humans
by: Sengupta, Akash, et al.
Published: (2024)
by: Sengupta, Akash, et al.
Published: (2024)
Score Distillation Sampling with Learned Manifold Corrective
by: Alldieck, Thiemo, et al.
Published: (2024)
by: Alldieck, Thiemo, et al.
Published: (2024)
THFM: A Unified Video Foundation Model for 4D Human Perception and Beyond
by: Wang, Letian, et al.
Published: (2026)
by: Wang, Letian, et al.
Published: (2026)
Kling-Avatar: Grounding Multimodal Instructions for Cascaded Long-Duration Avatar Animation Synthesis
by: Ding, Yikang, et al.
Published: (2025)
by: Ding, Yikang, et al.
Published: (2025)
DiffusionAvatars: Deferred Diffusion for High-fidelity 3D Head Avatars
by: Kirschstein, Tobias, et al.
Published: (2023)
by: Kirschstein, Tobias, et al.
Published: (2023)
EmbodiedHead: Real-Time Listening and Speaking Avatar for Conversational Agents
by: Zhang, Yu, et al.
Published: (2026)
by: Zhang, Yu, et al.
Published: (2026)
Learned Neural Physics Simulation for Articulated 3D Human Pose Reconstruction
by: Andriluka, Mykhaylo, et al.
Published: (2024)
by: Andriluka, Mykhaylo, et al.
Published: (2024)
NICP: Neural ICP for 3D Human Registration at Scale
by: Marin, Riccardo, et al.
Published: (2023)
by: Marin, Riccardo, et al.
Published: (2023)
ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance
by: Yang, Haijie, et al.
Published: (2024)
by: Yang, Haijie, et al.
Published: (2024)
Reflection Removal through Efficient Adaptation of Diffusion Transformers
by: Zakarin, Daniyar, et al.
Published: (2025)
by: Zakarin, Daniyar, et al.
Published: (2025)
EmbodiedEval: Evaluate Multimodal LLMs as Embodied Agents
by: Cheng, Zhili, et al.
Published: (2025)
by: Cheng, Zhili, et al.
Published: (2025)
Hyper Diffusion Avatars: Dynamic Human Avatar Generation using Network Weight Space Diffusion
by: Cao, Dongliang, et al.
Published: (2025)
by: Cao, Dongliang, et al.
Published: (2025)
UltrAvatar: A Realistic Animatable 3D Avatar Diffusion Model with Authenticity Guided Textures
by: Zhou, Mingyuan, et al.
Published: (2024)
by: Zhou, Mingyuan, et al.
Published: (2024)
EMOPortraits: Emotion-enhanced Multimodal One-shot Head Avatars
by: Drobyshev, Nikita, et al.
Published: (2024)
by: Drobyshev, Nikita, et al.
Published: (2024)
DynamicAvatars: Accurate Dynamic Facial Avatars Reconstruction and Precise Editing with Diffusion Models
by: Qian, Yangyang, et al.
Published: (2024)
by: Qian, Yangyang, et al.
Published: (2024)
GAS: Generative Avatar Synthesis from a Single Image
by: Lu, Yixing, et al.
Published: (2025)
by: Lu, Yixing, et al.
Published: (2025)
Multimodal Generation of Animatable 3D Human Models with AvatarForge
by: Liu, Xinhang, et al.
Published: (2025)
by: Liu, Xinhang, et al.
Published: (2025)
Coevolving Representations in Joint Image-Feature Diffusion
by: Kouzelis, Theodoros, et al.
Published: (2026)
by: Kouzelis, Theodoros, et al.
Published: (2026)
Controlling Avatar Diffusion with Learnable Gaussian Embedding
by: Gao, Xuan, et al.
Published: (2025)
by: Gao, Xuan, et al.
Published: (2025)
MEIA: Multimodal Embodied Perception and Interaction in Unknown Environments
by: Liu, Yang, et al.
Published: (2024)
by: Liu, Yang, et al.
Published: (2024)
Relightable Gaussian Codec Avatars
by: Saito, Shunsuke, et al.
Published: (2023)
by: Saito, Shunsuke, et al.
Published: (2023)
InstantAvatar: Efficient 3D Head Reconstruction via Surface Rendering
by: Canela, Antonio, et al.
Published: (2023)
by: Canela, Antonio, et al.
Published: (2023)
Contour Errors: An Ego-Centric Metric for Reliable 3D Multi-Object Tracking
by: Kaul, Sharang, et al.
Published: (2025)
by: Kaul, Sharang, et al.
Published: (2025)
AvatarArtist: Open-Domain 4D Avatarization
by: Liu, Hongyu, et al.
Published: (2025)
by: Liu, Hongyu, et al.
Published: (2025)
Human-3Diffusion: Realistic Avatar Creation via Explicit 3D Consistent Diffusion Models
by: Xue, Yuxuan, et al.
Published: (2024)
by: Xue, Yuxuan, et al.
Published: (2024)
Mind-to-Face: Neural-Driven Photorealistic Avatar Synthesis via EEG Decoding
by: Xiong, Haolin, et al.
Published: (2025)
by: Xiong, Haolin, et al.
Published: (2025)
RodinHD: High-Fidelity 3D Avatar Generation with Diffusion Models
by: Zhang, Bowen, et al.
Published: (2024)
by: Zhang, Bowen, et al.
Published: (2024)
Dual Diffusion Models for Multi-modal Guided 3D Avatar Generation
by: Li, Hong, et al.
Published: (2026)
by: Li, Hong, et al.
Published: (2026)
Advancing Semantic Future Prediction through Multimodal Visual Sequence Transformers
by: Karypidis, Efstathios, et al.
Published: (2025)
by: Karypidis, Efstathios, et al.
Published: (2025)
Motion Avatar: Generate Human and Animal Avatars with Arbitrary Motion
by: Zhang, Zeyu, et al.
Published: (2024)
by: Zhang, Zeyu, et al.
Published: (2024)
AvatarVTON: 4D Virtual Try-On for Animatable Avatars
by: Jiang, Zicheng, et al.
Published: (2025)
by: Jiang, Zicheng, et al.
Published: (2025)
InvertAvatar: Incremental GAN Inversion for Generalized Head Avatars
by: Zhao, Xiaochen, et al.
Published: (2023)
by: Zhao, Xiaochen, et al.
Published: (2023)
LegacyAvatars: Volumetric Face Avatars For Traditional Graphics Pipelines
by: Medin, Safa C., et al.
Published: (2026)
by: Medin, Safa C., et al.
Published: (2026)
STG-Avatar: Animatable Human Avatars via Spacetime Gaussian
by: Jiang, Guangan, et al.
Published: (2025)
by: Jiang, Guangan, et al.
Published: (2025)
AvatarPointillist: AutoRegressive 4D Gaussian Avatarization
by: Liu, Hongyu, et al.
Published: (2026)
by: Liu, Hongyu, et al.
Published: (2026)
HoliGS: Holistic Gaussian Splatting for Embodied View Synthesis
by: Wang, Xiaoyuan, et al.
Published: (2025)
by: Wang, Xiaoyuan, et al.
Published: (2025)
NavBench: Probing Multimodal Large Language Models for Embodied Navigation
by: Qiao, Yanyuan, et al.
Published: (2025)
by: Qiao, Yanyuan, et al.
Published: (2025)
High-Fidelity 3D Facial Avatar Synthesis with Controllable Fine-Grained Expressions
by: He, Yikang, et al.
Published: (2026)
by: He, Yikang, et al.
Published: (2026)
LightAvatar: Efficient Head Avatar as Dynamic Neural Light Field
by: Wang, Huan, et al.
Published: (2024)
by: Wang, Huan, et al.
Published: (2024)
Similar Items
-
Instant 3D Human Avatar Generation using Image Diffusion Models
by: Kolotouros, Nikos, et al.
Published: (2024) -
DiffHuman: Probabilistic Photorealistic 3D Reconstruction of Humans
by: Sengupta, Akash, et al.
Published: (2024) -
Score Distillation Sampling with Learned Manifold Corrective
by: Alldieck, Thiemo, et al.
Published: (2024) -
THFM: A Unified Video Foundation Model for 4D Human Perception and Beyond
by: Wang, Letian, et al.
Published: (2026) -
Kling-Avatar: Grounding Multimodal Instructions for Cascaded Long-Duration Avatar Animation Synthesis
by: Ding, Yikang, et al.
Published: (2025)