Direct3D: Scalable Image-to-3D Generation via 3D Latent Diffusion Transformer
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Shuang, Lin, Youtian, Zhang, Feihu, Zeng, Yifei, Xu, Jingxi, Torr, Philip, Cao, Xun, Yao, Yao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Direct3D-S2: Gigascale 3D Generation Made Easy with Spatial Sparse Attention
di: Wu, Shuang, et al.
Pubblicazione: (2025)
di: Wu, Shuang, et al.
Pubblicazione: (2025)
TEXTRIX: Latent Attribute Grid for Native Texture Generation and Beyond
di: Zeng, Yifei, et al.
Pubblicazione: (2025)
di: Zeng, Yifei, et al.
Pubblicazione: (2025)
STAG4D: Spatial-Temporal Anchored Generative 4D Gaussians
di: Zeng, Yifei, et al.
Pubblicazione: (2024)
di: Zeng, Yifei, et al.
Pubblicazione: (2024)
VFusion3D: Learning Scalable 3D Generative Models from Video Diffusion Models
di: Han, Junlin, et al.
Pubblicazione: (2024)
di: Han, Junlin, et al.
Pubblicazione: (2024)
Flow Distillation Sampling: Regularizing 3D Gaussians with Pre-trained Matching Priors
di: Chen, Lin-Zhuo, et al.
Pubblicazione: (2025)
di: Chen, Lin-Zhuo, et al.
Pubblicazione: (2025)
Relightable 3D Gaussians: Realistic Point Cloud Relighting with BRDF Decomposition and Ray Tracing
di: Gao, Jian, et al.
Pubblicazione: (2023)
di: Gao, Jian, et al.
Pubblicazione: (2023)
Direct2.5: Diverse Text-to-3D Generation via Multi-view 2.5D Diffusion
di: Lu, Yuanxun, et al.
Pubblicazione: (2023)
di: Lu, Yuanxun, et al.
Pubblicazione: (2023)
DreamPolisher: Towards High-Quality Text-to-3D Generation via Geometric Diffusion
di: Lin, Yuanze, et al.
Pubblicazione: (2024)
di: Lin, Yuanze, et al.
Pubblicazione: (2024)
Structured 3D Latents for Scalable and Versatile 3D Generation
di: Xiang, Jianfeng, et al.
Pubblicazione: (2024)
di: Xiang, Jianfeng, et al.
Pubblicazione: (2024)
EarthCrafter: Scalable 3D Earth Generation via Dual-Sparse Latent Diffusion
di: Liu, Shang, et al.
Pubblicazione: (2025)
di: Liu, Shang, et al.
Pubblicazione: (2025)
ComGS: Efficient 3D Object-Scene Composition via Surface Octahedral Probes
di: Gao, Jian, et al.
Pubblicazione: (2025)
di: Gao, Jian, et al.
Pubblicazione: (2025)
UniDream: Unifying Diffusion Priors for Relightable Text-to-3D Generation
di: Liu, Zexiang, et al.
Pubblicazione: (2023)
di: Liu, Zexiang, et al.
Pubblicazione: (2023)
PartCrafter: Structured 3D Mesh Generation via Compositional Latent Diffusion Transformers
di: Lin, Yuchen, et al.
Pubblicazione: (2025)
di: Lin, Yuchen, et al.
Pubblicazione: (2025)
DiffTF++: 3D-aware Diffusion Transformer for Large-Vocabulary 3D Generation
di: Cao, Ziang, et al.
Pubblicazione: (2024)
di: Cao, Ziang, et al.
Pubblicazione: (2024)
Self-Discovering Interpretable Diffusion Latent Directions for Responsible Text-to-Image Generation
di: Li, Hang, et al.
Pubblicazione: (2023)
di: Li, Hang, et al.
Pubblicazione: (2023)
SV3D: Novel Multi-view Synthesis and 3D Generation from a Single Image using Latent Video Diffusion
di: Voleti, Vikram, et al.
Pubblicazione: (2024)
di: Voleti, Vikram, et al.
Pubblicazione: (2024)
GarmentDiffusion: 3D Garment Sewing Pattern Generation with Multimodal Diffusion Transformers
di: Li, Xinyu, et al.
Pubblicazione: (2025)
di: Li, Xinyu, et al.
Pubblicazione: (2025)
LN3DIFF++: Scalable Latent Neural Fields Diffusion for Speedy 3D Generation
di: Lan, Yushi, et al.
Pubblicazione: (2024)
di: Lan, Yushi, et al.
Pubblicazione: (2024)
Champ: Controllable and Consistent Human Image Animation with 3D Parametric Guidance
di: Zhu, Shenhao, et al.
Pubblicazione: (2024)
di: Zhu, Shenhao, et al.
Pubblicazione: (2024)
Gen-3Diffusion: Realistic Image-to-3D Generation via 2D & 3D Diffusion Synergy
di: Xue, Yuxuan, et al.
Pubblicazione: (2024)
di: Xue, Yuxuan, et al.
Pubblicazione: (2024)
Ouroboros3D: Image-to-3D Generation via 3D-aware Recursive Diffusion
di: Wen, Hao, et al.
Pubblicazione: (2024)
di: Wen, Hao, et al.
Pubblicazione: (2024)
Towards Native Generative Model for 3D Head Avatar
di: Zhuang, Yiyu, et al.
Pubblicazione: (2024)
di: Zhuang, Yiyu, et al.
Pubblicazione: (2024)
Dual3D: Efficient and Consistent Text-to-3D Generation with Dual-mode Multi-view Latent Diffusion
di: Li, Xinyang, et al.
Pubblicazione: (2024)
di: Li, Xinyang, et al.
Pubblicazione: (2024)
Hi3D: Pursuing High-Resolution Image-to-3D Generation with Video Diffusion Models
di: Yang, Haibo, et al.
Pubblicazione: (2024)
di: Yang, Haibo, et al.
Pubblicazione: (2024)
Articulate3D: Zero-Shot Text-Driven 3D Object Posing
di: Deb, Oishi, et al.
Pubblicazione: (2025)
di: Deb, Oishi, et al.
Pubblicazione: (2025)
Assembler: Scalable 3D Part Assembly via Anchor Point Diffusion
di: Zhao, Wang, et al.
Pubblicazione: (2025)
di: Zhao, Wang, et al.
Pubblicazione: (2025)
3D Reconstruction from Transient Measurements with Time-Resolved Transformer
di: Li, Yue, et al.
Pubblicazione: (2025)
di: Li, Yue, et al.
Pubblicazione: (2025)
Flex3D: Feed-Forward 3D Generation with Flexible Reconstruction Model and Input View Curation
di: Han, Junlin, et al.
Pubblicazione: (2024)
di: Han, Junlin, et al.
Pubblicazione: (2024)
Semantic Score Distillation Sampling for Compositional Text-to-3D Generation
di: Yang, Ling, et al.
Pubblicazione: (2024)
di: Yang, Ling, et al.
Pubblicazione: (2024)
TeRA: Rethinking Text-guided Realistic 3D Avatar Generation
di: Wang, Yanwen, et al.
Pubblicazione: (2025)
di: Wang, Yanwen, et al.
Pubblicazione: (2025)
GLDiTalker: Speech-Driven 3D Facial Animation with Graph Latent Diffusion Transformer
di: Lin, Yihong, et al.
Pubblicazione: (2024)
di: Lin, Yihong, et al.
Pubblicazione: (2024)
SViM3D: Stable Video Material Diffusion for Single Image 3D Generation
di: Engelhardt, Andreas, et al.
Pubblicazione: (2025)
di: Engelhardt, Andreas, et al.
Pubblicazione: (2025)
CLIP3D-AD: Extending CLIP for 3D Few-Shot Anomaly Detection with Multi-View Images Generation
di: Zuo, Zuo, et al.
Pubblicazione: (2024)
di: Zuo, Zuo, et al.
Pubblicazione: (2024)
Edify 3D: Scalable High-Quality 3D Asset Generation
di: NVIDIA, et al.
Pubblicazione: (2024)
di: NVIDIA, et al.
Pubblicazione: (2024)
DB3D-L: Depth-aware BEV Feature Transformation for Accurate 3D Lane Detection
di: Liu, Yehao, et al.
Pubblicazione: (2025)
di: Liu, Yehao, et al.
Pubblicazione: (2025)
Scene-Conditional 3D Object Stylization and Composition
di: Zhou, Jinghao, et al.
Pubblicazione: (2023)
di: Zhou, Jinghao, et al.
Pubblicazione: (2023)
SceneFactor: Factored Latent 3D Diffusion for Controllable 3D Scene Generation
di: Bokhovkin, Alexey, et al.
Pubblicazione: (2024)
di: Bokhovkin, Alexey, et al.
Pubblicazione: (2024)
MetaEarth3D: Unlocking World-scale 3D Generation with Spatially Scalable Generative Modeling
di: Cao, Jinqi, et al.
Pubblicazione: (2026)
di: Cao, Jinqi, et al.
Pubblicazione: (2026)
EmoTalk3D: High-Fidelity Free-View Synthesis of Emotional 3D Talking Head
di: He, Qianyun, et al.
Pubblicazione: (2024)
di: He, Qianyun, et al.
Pubblicazione: (2024)
SAM 3D for 3D Object Reconstruction from Remote Sensing Images
di: Yao, Junsheng, et al.
Pubblicazione: (2025)
di: Yao, Junsheng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Direct3D-S2: Gigascale 3D Generation Made Easy with Spatial Sparse Attention
di: Wu, Shuang, et al.
Pubblicazione: (2025) -
TEXTRIX: Latent Attribute Grid for Native Texture Generation and Beyond
di: Zeng, Yifei, et al.
Pubblicazione: (2025) -
STAG4D: Spatial-Temporal Anchored Generative 4D Gaussians
di: Zeng, Yifei, et al.
Pubblicazione: (2024) -
VFusion3D: Learning Scalable 3D Generative Models from Video Diffusion Models
di: Han, Junlin, et al.
Pubblicazione: (2024) -
Flow Distillation Sampling: Regularizing 3D Gaussians with Pre-trained Matching Priors
di: Chen, Lin-Zhuo, et al.
Pubblicazione: (2025)