FashionEngine: Interactive 3D Human Generation and Editing via Multimodal Controls
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hu, Tao, Hong, Fangzhou, Chen, Zhaoxi, Liu, Ziwei |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Generative Gaussian Splatting for Unbounded 3D City Generation
par: Xie, Haozhe, et autres
Publié: (2024)
par: Xie, Haozhe, et autres
Publié: (2024)
StructLDM: Structured Latent Diffusion for 3D Human Generation
par: Hu, Tao, et autres
Publié: (2024)
par: Hu, Tao, et autres
Publié: (2024)
CityDreamer: Compositional Generative Model of Unbounded 3D Cities
par: Xie, Haozhe, et autres
Publié: (2023)
par: Xie, Haozhe, et autres
Publié: (2023)
Compositional Generative Model of Unbounded 4D Cities
par: Xie, Haozhe, et autres
Publié: (2025)
par: Xie, Haozhe, et autres
Publié: (2025)
3D Scene Generation: A Survey
par: Wen, Beichen, et autres
Publié: (2025)
par: Wen, Beichen, et autres
Publié: (2025)
SurMo: Surface-based 4D Motion Modeling for Dynamic Human Rendering
par: Hu, Tao, et autres
Publié: (2024)
par: Hu, Tao, et autres
Publié: (2024)
HSImul3R: Physics-in-the-Loop Reconstruction of Simulation-Ready Human-Scene Interactions
par: Cao, Yukang, et autres
Publié: (2026)
par: Cao, Yukang, et autres
Publié: (2026)
PhysX-Anything: Simulation-Ready Physical 3D Assets from Single Image
par: Cao, Ziang, et autres
Publié: (2025)
par: Cao, Ziang, et autres
Publié: (2025)
PhysX-3D: Physical-Grounded 3D Asset Generation
par: Cao, Ziang, et autres
Publié: (2025)
par: Cao, Ziang, et autres
Publié: (2025)
4DNeX: Feed-Forward 4D Generative Modeling Made Easy
par: Chen, Zhaoxi, et autres
Publié: (2025)
par: Chen, Zhaoxi, et autres
Publié: (2025)
PhysX-Omni: Unified Simulation-Ready Physical 3D Generation for Rigid, Deformable, and Articulated Objects
par: Cao, Ziang, et autres
Publié: (2026)
par: Cao, Ziang, et autres
Publié: (2026)
Collaborative Multi-Modal Coding for High-Quality 3D Generation
par: Cao, Ziang, et autres
Publié: (2025)
par: Cao, Ziang, et autres
Publié: (2025)
DiffTF++: 3D-aware Diffusion Transformer for Large-Vocabulary 3D Generation
par: Cao, Ziang, et autres
Publié: (2024)
par: Cao, Ziang, et autres
Publié: (2024)
Fashion Style Editing with Generative Human Prior
par: Kong, Chaerin, et autres
Publié: (2024)
par: Kong, Chaerin, et autres
Publié: (2024)
3DTopia: Large Text-to-3D Generation Model with Hybrid Diffusion Priors
par: Hong, Fangzhou, et autres
Publié: (2024)
par: Hong, Fangzhou, et autres
Publié: (2024)
OnlineSI: Taming Large Language Model for Online 3D Understanding and Grounding
par: Liu, Zixian, et autres
Publié: (2026)
par: Liu, Zixian, et autres
Publié: (2026)
LongVie: Multimodal-Guided Controllable Ultra-Long Video Generation
par: Gao, Jianxiong, et autres
Publié: (2025)
par: Gao, Jianxiong, et autres
Publié: (2025)
Fashion-RAG: Multimodal Fashion Image Editing via Retrieval-Augmented Generation
par: Sanguigni, Fulvio, et autres
Publié: (2025)
par: Sanguigni, Fulvio, et autres
Publié: (2025)
3DTopia-XL: Scaling High-quality 3D Asset Generation via Primitive Diffusion
par: Chen, Zhaoxi, et autres
Publié: (2024)
par: Chen, Zhaoxi, et autres
Publié: (2024)
Rethinking Cross-Modal Interaction in Multimodal Diffusion Transformers
par: Lv, Zhengyao, et autres
Publié: (2025)
par: Lv, Zhengyao, et autres
Publié: (2025)
DynamicVLA: A Vision-Language-Action Model for Dynamic Object Manipulation
par: Xie, Haozhe, et autres
Publié: (2026)
par: Xie, Haozhe, et autres
Publié: (2026)
GeneMAN: Generalizable Single-Image 3D Human Reconstruction from Multi-Source Human Data
par: Wang, Wentao, et autres
Publié: (2024)
par: Wang, Wentao, et autres
Publié: (2024)
ArtHOI: Articulated Human-Object Interaction Synthesis by 4D Reconstruction from Video Priors
par: Huang, Zihao, et autres
Publié: (2026)
par: Huang, Zihao, et autres
Publié: (2026)
Reconstructing 4D Spatial Intelligence: A Survey
par: Cao, Yukang, et autres
Publié: (2025)
par: Cao, Yukang, et autres
Publié: (2025)
Multimodal-Conditioned Latent Diffusion Models for Fashion Image Editing
par: Baldrati, Alberto, et autres
Publié: (2024)
par: Baldrati, Alberto, et autres
Publié: (2024)
LGM: Large Multi-View Gaussian Model for High-Resolution 3D Content Creation
par: Tang, Jiaxiang, et autres
Publié: (2024)
par: Tang, Jiaxiang, et autres
Publié: (2024)
MonoArt: Progressive Structural Reasoning for Monocular Articulated 3D Reconstruction
par: Li, Haitian, et autres
Publié: (2026)
par: Li, Haitian, et autres
Publié: (2026)
LongVie 2: Multimodal Controllable Ultra-Long Video World Model
par: Gao, Jianxiong, et autres
Publié: (2025)
par: Gao, Jianxiong, et autres
Publié: (2025)
Light-X: Generative 4D Video Rendering with Camera and Illumination Control
par: Liu, Tianqi, et autres
Publié: (2025)
par: Liu, Tianqi, et autres
Publié: (2025)
Free4D: Tuning-free 4D Scene Generation with Spatial-Temporal Consistency
par: Liu, Tianqi, et autres
Publié: (2025)
par: Liu, Tianqi, et autres
Publié: (2025)
FreeTraj: Tuning-Free Trajectory Control in Video Diffusion Models
par: Qiu, Haonan, et autres
Publié: (2024)
par: Qiu, Haonan, et autres
Publié: (2024)
Kinema4D: Kinematic 4D World Modeling for Spatiotemporal Embodied Simulation
par: Xu, Mutian, et autres
Publié: (2026)
par: Xu, Mutian, et autres
Publié: (2026)
InteractEdit: Zero-Shot Editing of Human-Object Interactions in Images
par: Hoe, Jiun Tian, et autres
Publié: (2025)
par: Hoe, Jiun Tian, et autres
Publié: (2025)
Multimodal Priors-Augmented Text-Driven 3D Human-Object Interaction Generation
par: Wang, Yin, et autres
Publié: (2026)
par: Wang, Yin, et autres
Publié: (2026)
FashionComposer: Compositional Fashion Image Generation
par: Ji, Sihui, et autres
Publié: (2024)
par: Ji, Sihui, et autres
Publié: (2024)
AvatarGO: Zero-shot 4D Human-Object Interaction Generation and Animation
par: Cao, Yukang, et autres
Publié: (2024)
par: Cao, Yukang, et autres
Publié: (2024)
DPDEdit: Detail-Preserved Diffusion Models for Multimodal Fashion Image Editing
par: Wang, Xiaolong, et autres
Publié: (2024)
par: Wang, Xiaolong, et autres
Publié: (2024)
CMD: Controllable Multiview Diffusion for 3D Editing and Progressive Generation
par: Li, Peng, et autres
Publié: (2025)
par: Li, Peng, et autres
Publié: (2025)
Avatar Concept Slider: Controllable Editing of Concepts in 3D Human Avatars
par: Foo, Lin Geng, et autres
Publié: (2024)
par: Foo, Lin Geng, et autres
Publié: (2024)
HumanGaussian: Text-Driven 3D Human Generation with Gaussian Splatting
par: Liu, Xian, et autres
Publié: (2023)
par: Liu, Xian, et autres
Publié: (2023)
Documents similaires
-
Generative Gaussian Splatting for Unbounded 3D City Generation
par: Xie, Haozhe, et autres
Publié: (2024) -
StructLDM: Structured Latent Diffusion for 3D Human Generation
par: Hu, Tao, et autres
Publié: (2024) -
CityDreamer: Compositional Generative Model of Unbounded 3D Cities
par: Xie, Haozhe, et autres
Publié: (2023) -
Compositional Generative Model of Unbounded 4D Cities
par: Xie, Haozhe, et autres
Publié: (2025) -
3D Scene Generation: A Survey
par: Wen, Beichen, et autres
Publié: (2025)