Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers
Fuente:
arXiv
Salvato in:
| Autori principali: | Srivastava, Divyansh, Zhang, Xiang, Wen, He, Wen, Chenru, Tu, Zhuowen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
OverLayBench: A Benchmark for Layout-to-Image Generation with Dense Overlaps
di: Li, Bingnan, et al.
Pubblicazione: (2025)
di: Li, Bingnan, et al.
Pubblicazione: (2025)
PixARMesh: Autoregressive Mesh-Native Single-View Scene Reconstruction
di: Zhang, Xiang, et al.
Pubblicazione: (2026)
di: Zhang, Xiang, et al.
Pubblicazione: (2026)
Disentangled 3D Scene Generation with Layout Learning
di: Epstein, Dave, et al.
Pubblicazione: (2024)
di: Epstein, Dave, et al.
Pubblicazione: (2024)
Do Vision--Language Models Understand 3D Scenes or Just Catalogue Objects?
di: Maheshwari, Animesh, et al.
Pubblicazione: (2026)
di: Maheshwari, Animesh, et al.
Pubblicazione: (2026)
Bayesian Diffusion Models for 3D Shape Reconstruction
di: Xu, Haiyang, et al.
Pubblicazione: (2024)
di: Xu, Haiyang, et al.
Pubblicazione: (2024)
Dependency-Aware Discrete Diffusion for Scene Graph Generation
di: Rajagopalan, Rajalaxmi, et al.
Pubblicazione: (2026)
di: Rajagopalan, Rajalaxmi, et al.
Pubblicazione: (2026)
EchoScene: Indoor Scene Generation via Information Echo over Scene Graph Diffusion
di: Zhai, Guangyao, et al.
Pubblicazione: (2024)
di: Zhai, Guangyao, et al.
Pubblicazione: (2024)
RoboLayout: Differentiable 3D Scene Generation for Embodied Agents
di: Shamsaddinlou, Ali
Pubblicazione: (2026)
di: Shamsaddinlou, Ali
Pubblicazione: (2026)
EGTR: Extracting Graph from Transformer for Scene Graph Generation
di: Im, Jinbae, et al.
Pubblicazione: (2024)
di: Im, Jinbae, et al.
Pubblicazione: (2024)
OmniControlNet: Dual-stage Integration for Conditional Image Generation
di: Wang, Yilin, et al.
Pubblicazione: (2024)
di: Wang, Yilin, et al.
Pubblicazione: (2024)
VLG-CBM: Training Concept Bottleneck Models with Vision-Language Guidance
di: Srivastava, Divyansh, et al.
Pubblicazione: (2024)
di: Srivastava, Divyansh, et al.
Pubblicazione: (2024)
Efficient Scaling of Diffusion Transformers for Text-to-Image Generation
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
DepR: Depth Guided Single-view Scene Reconstruction with Instance-level Diffusion
di: Zhao, Qingcheng, et al.
Pubblicazione: (2025)
di: Zhao, Qingcheng, et al.
Pubblicazione: (2025)
Vision Transformer for Transient Noise Classification
di: Srivastava, Divyansh, et al.
Pubblicazione: (2025)
di: Srivastava, Divyansh, et al.
Pubblicazione: (2025)
Layout2Scene: 3D Semantic Layout Guided Scene Generation via Geometry and Appearance Diffusion Priors
di: Chen, Minglin, et al.
Pubblicazione: (2025)
di: Chen, Minglin, et al.
Pubblicazione: (2025)
Lay2Story: Extending Diffusion Transformers for Layout-Togglable Story Generation
di: Ma, Ao, et al.
Pubblicazione: (2025)
di: Ma, Ao, et al.
Pubblicazione: (2025)
Free Lunch for Stabilizing Rectified Flow Inversion
di: Wang, Chenru, et al.
Pubblicazione: (2026)
di: Wang, Chenru, et al.
Pubblicazione: (2026)
Draw Like an Artist: Complex Scene Generation with Diffusion Model via Composition, Painting, and Retouching
di: Liu, Minghao, et al.
Pubblicazione: (2024)
di: Liu, Minghao, et al.
Pubblicazione: (2024)
Unbiased Scene Graph Generation from Biased Training
di: Tang, Kaihua, et al.
Pubblicazione: (2020)
di: Tang, Kaihua, et al.
Pubblicazione: (2020)
SceneAlign: Aligning Multimodal Reasoning to Scene Graphs in Complex Visual Scenes
di: Wang, Chuhan, et al.
Pubblicazione: (2026)
di: Wang, Chuhan, et al.
Pubblicazione: (2026)
GrabS: Generative Embodied Agent for 3D Object Segmentation without Scene Supervision
di: Zhang, Zihui, et al.
Pubblicazione: (2025)
di: Zhang, Zihui, et al.
Pubblicazione: (2025)
Holistic Order Prediction in Natural Scenes
di: Musacchio, Pierre, et al.
Pubblicazione: (2025)
di: Musacchio, Pierre, et al.
Pubblicazione: (2025)
Generate Any Scene: Scene Graph Driven Data Synthesis for Visual Generation Training
di: Gao, Ziqi, et al.
Pubblicazione: (2024)
di: Gao, Ziqi, et al.
Pubblicazione: (2024)
Towards Aligned Layout Generation via Diffusion Model with Aesthetic Constraints
di: Chen, Jian, et al.
Pubblicazione: (2024)
di: Chen, Jian, et al.
Pubblicazione: (2024)
Generating Compositional Scenes via Text-to-image RGBA Instance Generation
di: Fontanella, Alessandro, et al.
Pubblicazione: (2024)
di: Fontanella, Alessandro, et al.
Pubblicazione: (2024)
SceneTok: A Compressed, Diffusable Token Space for 3D Scenes
di: Asim, Mohammad, et al.
Pubblicazione: (2026)
di: Asim, Mohammad, et al.
Pubblicazione: (2026)
EP-Diffuser: An Efficient Diffusion Model for Traffic Scene Generation and Prediction via Polynomial Representations
di: Yao, Yue, et al.
Pubblicazione: (2025)
di: Yao, Yue, et al.
Pubblicazione: (2025)
Learning 3D Scene Analogies with Neural Contextual Scene Maps
di: Kim, Junho, et al.
Pubblicazione: (2025)
di: Kim, Junho, et al.
Pubblicazione: (2025)
LiDAR-EDIT: LiDAR Data Generation by Editing the Object Layouts in Real-World Scenes
di: Ho, Shing-Hei, et al.
Pubblicazione: (2024)
di: Ho, Shing-Hei, et al.
Pubblicazione: (2024)
LVT: Large-Scale Scene Reconstruction via Local View Transformers
di: Imtiaz, Tooba, et al.
Pubblicazione: (2025)
di: Imtiaz, Tooba, et al.
Pubblicazione: (2025)
Sampling 3D Gaussian Scenes in Seconds with Latent Diffusion Models
di: Henderson, Paul, et al.
Pubblicazione: (2024)
di: Henderson, Paul, et al.
Pubblicazione: (2024)
Data Augmentation for Surgical Scene Segmentation with Anatomy-Aware Diffusion Models
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2024)
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2024)
SceneCraft: Layout-Guided 3D Scene Generation
di: Yang, Xiuyu, et al.
Pubblicazione: (2024)
di: Yang, Xiuyu, et al.
Pubblicazione: (2024)
Salient Temporal Encoding for Dynamic Scene Graph Generation
di: Zhu, Zhihao
Pubblicazione: (2025)
di: Zhu, Zhihao
Pubblicazione: (2025)
Multisource Collaborative Domain Generalization for Cross-Scene Remote Sensing Image Classification
di: Han, Zhu, et al.
Pubblicazione: (2024)
di: Han, Zhu, et al.
Pubblicazione: (2024)
UniLayDiff: A Unified Diffusion Transformer for Content-Aware Layout Generation
di: Liu, Zeyang, et al.
Pubblicazione: (2025)
di: Liu, Zeyang, et al.
Pubblicazione: (2025)
ESGNN: Towards Equivariant Scene Graph Neural Network for 3D Scene Understanding
di: Pham, Quang P. M., et al.
Pubblicazione: (2024)
di: Pham, Quang P. M., et al.
Pubblicazione: (2024)
A Review and Efficient Implementation of Scene Graph Generation Metrics
di: Lorenz, Julian, et al.
Pubblicazione: (2024)
di: Lorenz, Julian, et al.
Pubblicazione: (2024)
DiffPattern-Flex: Efficient Layout Pattern Generation via Discrete Diffusion
di: Wang, Zixiao, et al.
Pubblicazione: (2025)
di: Wang, Zixiao, et al.
Pubblicazione: (2025)
ViTGAN: Training GANs with Vision Transformers
di: Lee, Kwonjoon, et al.
Pubblicazione: (2021)
di: Lee, Kwonjoon, et al.
Pubblicazione: (2021)
Documenti analoghi
-
OverLayBench: A Benchmark for Layout-to-Image Generation with Dense Overlaps
di: Li, Bingnan, et al.
Pubblicazione: (2025) -
PixARMesh: Autoregressive Mesh-Native Single-View Scene Reconstruction
di: Zhang, Xiang, et al.
Pubblicazione: (2026) -
Disentangled 3D Scene Generation with Layout Learning
di: Epstein, Dave, et al.
Pubblicazione: (2024) -
Do Vision--Language Models Understand 3D Scenes or Just Catalogue Objects?
di: Maheshwari, Animesh, et al.
Pubblicazione: (2026) -
Bayesian Diffusion Models for 3D Shape Reconstruction
di: Xu, Haiyang, et al.
Pubblicazione: (2024)