Prometheus: 3D-Aware Latent Diffusion Models for Feed-Forward Text-to-3D Scene Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Yang, Yuanbo, Shao, Jiahao, Li, Xinyang, Shen, Yujun, Geiger, Andreas, Liao, Yiyi |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Gen3R: 3D Scene Generation Meets Feed-Forward Reconstruction
by: Huang, Jiaxin, et al.
Published: (2026)
by: Huang, Jiaxin, et al.
Published: (2026)
ScenDi: 3D-to-2D Scene Diffusion Cascades for Urban Generation
by: Guo, Hanlei, et al.
Published: (2026)
by: Guo, Hanlei, et al.
Published: (2026)
PrITTI: Primitive-based Generation of Controllable and Editable 3D Semantic Urban Scenes
by: Tze, Christina Ourania, et al.
Published: (2025)
by: Tze, Christina Ourania, et al.
Published: (2025)
HUGS: Holistic Urban 3D Scene Understanding via Gaussian Splatting
by: Zhou, Hongyu, et al.
Published: (2024)
by: Zhou, Hongyu, et al.
Published: (2024)
Learning 3D-Aware GANs from Unposed Images with Template Feature Field
by: Chen, Xinya, et al.
Published: (2024)
by: Chen, Xinya, et al.
Published: (2024)
Orientation Matters: Making 3D Generative Models Orientation-Aligned
by: Lu, Yichong, et al.
Published: (2025)
by: Lu, Yichong, et al.
Published: (2025)
Feed-Forward 3D Scene Modeling: A Problem-Driven Perspective
by: Wang, Weijie, et al.
Published: (2026)
by: Wang, Weijie, et al.
Published: (2026)
PanopticNeRF-360: Panoramic 3D-to-2D Label Transfer in Urban Scenes
by: Fu, Xiao, et al.
Published: (2023)
by: Fu, Xiao, et al.
Published: (2023)
Learning Temporally Consistent Video Depth from Video Diffusion Priors
by: Shao, Jiahao, et al.
Published: (2024)
by: Shao, Jiahao, et al.
Published: (2024)
WildFusion: Learning 3D-Aware Latent Diffusion Models in View Space
by: Schwarz, Katja, et al.
Published: (2023)
by: Schwarz, Katja, et al.
Published: (2023)
DriveGen3D: Boosting Feed-Forward Driving Scene Generation with Efficient Video Diffusion
by: Wang, Weijie, et al.
Published: (2025)
by: Wang, Weijie, et al.
Published: (2025)
The Constant Eye: Benchmarking and Bridging Appearance Robustness in Autonomous Driving
by: Wang, Jiabao, et al.
Published: (2026)
by: Wang, Jiabao, et al.
Published: (2026)
UrbanCAD: Towards Highly Controllable and Photorealistic 3D Vehicles for Urban Scene Simulation
by: Lu, Yichong, et al.
Published: (2024)
by: Lu, Yichong, et al.
Published: (2024)
GANFusion: Feed-Forward Text-to-3D with Diffusion in GAN Space
by: Attaiki, Souhaib, et al.
Published: (2024)
by: Attaiki, Souhaib, et al.
Published: (2024)
SemanticSplat: Feed-Forward 3D Scene Understanding with Language-Aware Gaussian Fields
by: Li, Qijing, et al.
Published: (2025)
by: Li, Qijing, et al.
Published: (2025)
Dual3D: Efficient and Consistent Text-to-3D Generation with Dual-mode Multi-view Latent Diffusion
by: Li, Xinyang, et al.
Published: (2024)
by: Li, Xinyang, et al.
Published: (2024)
SceneFactor: Factored Latent 3D Diffusion for Controllable 3D Scene Generation
by: Bokhovkin, Alexey, et al.
Published: (2024)
by: Bokhovkin, Alexey, et al.
Published: (2024)
UAVFF3D: A Geometry-Aware Benchmark for Feed-Forward UAV 3D Reconstruction
by: Yang, Xiang, et al.
Published: (2026)
by: Yang, Xiang, et al.
Published: (2026)
EVolSplat4D: Efficient Volume-based Gaussian Splatting for 4D Urban Scene Synthesis
by: Miao, Sheng, et al.
Published: (2026)
by: Miao, Sheng, et al.
Published: (2026)
TriSplat: Simulation-Ready Feed-Forward 3D Scene Reconstruction
by: Wang, Weijie, et al.
Published: (2026)
by: Wang, Weijie, et al.
Published: (2026)
ReRoPE: Repurposing RoPE for Relative Camera Control
by: Li, Chunyang, et al.
Published: (2026)
by: Li, Chunyang, et al.
Published: (2026)
Pano3DComposer: Feed-Forward Compositional 3D Scene Generation from Single Panoramic Image
by: Qiu, Zidian, et al.
Published: (2026)
by: Qiu, Zidian, et al.
Published: (2026)
Flash3D: Feed-Forward Generalisable 3D Scene Reconstruction from a Single Image
by: Szymanowicz, Stanislaw, et al.
Published: (2024)
by: Szymanowicz, Stanislaw, et al.
Published: (2024)
Leveling3D: Leveling Up 3D Reconstruction with Feed-Forward 3D Gaussian Splatting and Geometry-Aware Generation
by: Huang, Yiming, et al.
Published: (2026)
by: Huang, Yiming, et al.
Published: (2026)
PLANA3R: Zero-shot Metric Planar 3D Reconstruction via Feed-Forward Planar Splatting
by: Liu, Changkun, et al.
Published: (2025)
by: Liu, Changkun, et al.
Published: (2025)
DelowlightSplat: Feed-Forward Gaussian Splatting for Lowlight 3D Scene Reconstruction
by: Jiang, Fuzhen, et al.
Published: (2026)
by: Jiang, Fuzhen, et al.
Published: (2026)
Feed-Forward 3D Gaussian Splatting Compression with Long-Context Modeling
by: Liu, Zhening, et al.
Published: (2025)
by: Liu, Zhening, et al.
Published: (2025)
Director3D: Real-world Camera Trajectory and 3D Scene Generation from Text
by: Li, Xinyang, et al.
Published: (2024)
by: Li, Xinyang, et al.
Published: (2024)
DreamScene: 3D Gaussian-based End-to-end Text-to-3D Scene Generation
by: Li, Haoran, et al.
Published: (2025)
by: Li, Haoran, et al.
Published: (2025)
3D-LATTE: Latent Space 3D Editing from Textual Instructions
by: Parelli, Maria, et al.
Published: (2025)
by: Parelli, Maria, et al.
Published: (2025)
FUSER: Feed-Forward MUltiview 3D Registration Transformer and SE(3)$^N$ Diffusion Refinement
by: Jiang, Haobo, et al.
Published: (2025)
by: Jiang, Haobo, et al.
Published: (2025)
WorldSplat: Gaussian-Centric Feed-Forward 4D Scene Generation for Autonomous Driving
by: Zhu, Ziyue, et al.
Published: (2025)
by: Zhu, Ziyue, et al.
Published: (2025)
MaPa: Text-driven Photorealistic Material Painting for 3D Shapes
by: Zhang, Shangzan, et al.
Published: (2024)
by: Zhang, Shangzan, et al.
Published: (2024)
DenoiseSplat: Feed-Forward Gaussian Splatting for Noisy 3D Scene Reconstruction
by: Jiang, Fuzhen, et al.
Published: (2026)
by: Jiang, Fuzhen, et al.
Published: (2026)
EmbodiedSplat: Online Feed-Forward Semantic 3DGS for Open-Vocabulary 3D Scene Understanding
by: Lee, Seungjun, et al.
Published: (2026)
by: Lee, Seungjun, et al.
Published: (2026)
Revisiting Depth Representations for Feed-Forward 3D Gaussian Splatting
by: Shi, Duochao, et al.
Published: (2025)
by: Shi, Duochao, et al.
Published: (2025)
HeadArtist: Text-conditioned 3D Head Generation with Self Score Distillation
by: Liu, Hongyu, et al.
Published: (2023)
by: Liu, Hongyu, et al.
Published: (2023)
ForeSplat: Optimization-Aware Foresight for Feed-Forward 3D Gaussian Splatting
by: Li, Yuke, et al.
Published: (2026)
by: Li, Yuke, et al.
Published: (2026)
F4Splat: Feed-Forward Predictive Densification for Feed-Forward 3D Gaussian Splatting
by: Kim, Injae, et al.
Published: (2026)
by: Kim, Injae, et al.
Published: (2026)
GlobalSplat: Efficient Feed-Forward 3D Gaussian Splatting via Global Scene Tokens
by: Itkin, Roni, et al.
Published: (2026)
by: Itkin, Roni, et al.
Published: (2026)
Similar Items
-
Gen3R: 3D Scene Generation Meets Feed-Forward Reconstruction
by: Huang, Jiaxin, et al.
Published: (2026) -
ScenDi: 3D-to-2D Scene Diffusion Cascades for Urban Generation
by: Guo, Hanlei, et al.
Published: (2026) -
PrITTI: Primitive-based Generation of Controllable and Editable 3D Semantic Urban Scenes
by: Tze, Christina Ourania, et al.
Published: (2025) -
HUGS: Holistic Urban 3D Scene Understanding via Gaussian Splatting
by: Zhou, Hongyu, et al.
Published: (2024) -
Learning 3D-Aware GANs from Unposed Images with Template Feature Field
by: Chen, Xinya, et al.
Published: (2024)