Controllable 3D Placement of Objects with Scene-Aware Diffusion Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Omran, Mohamed, Kalatzis, Dimitris, Petersen, Jens, Habibian, Amirhossein, Wiggers, Auke |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Scene-Aware Location Modeling for Data Augmentation in Automotive Object Detection
di: Petersen, Jens, et al.
Pubblicazione: (2025)
di: Petersen, Jens, et al.
Pubblicazione: (2025)
Gaussian Splatting is an Effective Data Generator for 3D Object Detection
di: Zanjani, Farhad G., et al.
Pubblicazione: (2025)
di: Zanjani, Farhad G., et al.
Pubblicazione: (2025)
Imagining the Unseen: Generative Location Modeling for Object Placement
di: Yun, Jooyeol, et al.
Pubblicazione: (2024)
di: Yun, Jooyeol, et al.
Pubblicazione: (2024)
Hybrid Gaussian Splatting for Novel Urban View Synthesis
di: Omran, Mohamed, et al.
Pubblicazione: (2025)
di: Omran, Mohamed, et al.
Pubblicazione: (2025)
ReHyAt: Recurrent Hybrid Attention for Video Diffusion Transformers
di: Ghafoorian, Mohsen, et al.
Pubblicazione: (2026)
di: Ghafoorian, Mohsen, et al.
Pubblicazione: (2026)
Clockwork Diffusion: Efficient Generation With Model-Step Distillation
di: Habibian, Amirhossein, et al.
Pubblicazione: (2023)
di: Habibian, Amirhossein, et al.
Pubblicazione: (2023)
Attention Surgery: An Efficient Recipe to Linearize Your Video Diffusion Transformer
di: Ghafoorian, Mohsen, et al.
Pubblicazione: (2025)
di: Ghafoorian, Mohsen, et al.
Pubblicazione: (2025)
Enhancing Novel View Synthesis via Geometry Grounded Set Diffusion
di: Zanjani, Farhad G., et al.
Pubblicazione: (2026)
di: Zanjani, Farhad G., et al.
Pubblicazione: (2026)
Object-Centric Diffusion for Efficient Video Editing
di: Kahatapitiya, Kumara, et al.
Pubblicazione: (2024)
di: Kahatapitiya, Kumara, et al.
Pubblicazione: (2024)
Multi-Scale Local Speculative Decoding for Image Generation
di: Peruzzo, Elia, et al.
Pubblicazione: (2026)
di: Peruzzo, Elia, et al.
Pubblicazione: (2026)
MoAlign: Motion-Centric Representation Alignment for Video Diffusion Models
di: Bhowmik, Aritra, et al.
Pubblicazione: (2025)
di: Bhowmik, Aritra, et al.
Pubblicazione: (2025)
MoViE: Mobile Diffusion for Video Editing
di: Karjauv, Adil, et al.
Pubblicazione: (2024)
di: Karjauv, Adil, et al.
Pubblicazione: (2024)
PyramidalWan: On Making Pretrained Video Model Pyramidal for Efficient Inference
di: Korzhenkov, Denis, et al.
Pubblicazione: (2026)
di: Korzhenkov, Denis, et al.
Pubblicazione: (2026)
Mobile Video Diffusion
di: Yahia, Haitam Ben, et al.
Pubblicazione: (2024)
di: Yahia, Haitam Ben, et al.
Pubblicazione: (2024)
Toward Intelligent Scene Augmentation for Context-Aware Object Placement and Sponsor-Logo Integration
di: Saraswat, Unnati, et al.
Pubblicazione: (2025)
di: Saraswat, Unnati, et al.
Pubblicazione: (2025)
MonoPlace3D: Learning 3D-Aware Object Placement for 3D Monocular Detection
di: Parihar, Rishubh, et al.
Pubblicazione: (2025)
di: Parihar, Rishubh, et al.
Pubblicazione: (2025)
PlaceIt3D: Language-Guided Object Placement in Real 3D Scenes
di: Abdelreheem, Ahmed, et al.
Pubblicazione: (2025)
di: Abdelreheem, Ahmed, et al.
Pubblicazione: (2025)
Gated Relational Alignment via Confidence-based Distillation for Efficient VLMs
di: Chen, Yanlong, et al.
Pubblicazione: (2026)
di: Chen, Yanlong, et al.
Pubblicazione: (2026)
SceneFactor: Factored Latent 3D Diffusion for Controllable 3D Scene Generation
di: Bokhovkin, Alexey, et al.
Pubblicazione: (2024)
di: Bokhovkin, Alexey, et al.
Pubblicazione: (2024)
Uncertainty-Aware Diffusion Guided Refinement of 3D Scenes
di: Bose, Sarosij, et al.
Pubblicazione: (2025)
di: Bose, Sarosij, et al.
Pubblicazione: (2025)
Scaling Diffusion Models to Real-World 3D LiDAR Scene Completion
di: Nunes, Lucas, et al.
Pubblicazione: (2024)
di: Nunes, Lucas, et al.
Pubblicazione: (2024)
HiddenObjects: Scalable Diffusion-Distilled Spatial Priors for Object Placement
di: Schouten, Marco, et al.
Pubblicazione: (2026)
di: Schouten, Marco, et al.
Pubblicazione: (2026)
Prometheus: 3D-Aware Latent Diffusion Models for Feed-Forward Text-to-3D Scene Generation
di: Yang, Yuanbo, et al.
Pubblicazione: (2024)
di: Yang, Yuanbo, et al.
Pubblicazione: (2024)
Human-Aware 3D Scene Generation with Spatially-constrained Diffusion Models
di: Hong, Xiaolin, et al.
Pubblicazione: (2024)
di: Hong, Xiaolin, et al.
Pubblicazione: (2024)
3D Roadway Scene Object Detection with LIDARs in Snowfall Conditions
di: Farhani, Ghazal, et al.
Pubblicazione: (2025)
di: Farhani, Ghazal, et al.
Pubblicazione: (2025)
Neural Assets: 3D-Aware Multi-Object Scene Synthesis with Image Diffusion Models
di: Wu, Ziyi, et al.
Pubblicazione: (2024)
di: Wu, Ziyi, et al.
Pubblicazione: (2024)
Chat-Scene: Bridging 3D Scene and Large Language Models with Object Identifiers
di: Huang, Haifeng, et al.
Pubblicazione: (2023)
di: Huang, Haifeng, et al.
Pubblicazione: (2023)
Is Your LiDAR Placement Optimized for 3D Scene Understanding?
di: Li, Ye, et al.
Pubblicazione: (2024)
di: Li, Ye, et al.
Pubblicazione: (2024)
DifFlow3D: Toward Robust Uncertainty-Aware Scene Flow Estimation with Diffusion Model
di: Liu, Jiuming, et al.
Pubblicazione: (2023)
di: Liu, Jiuming, et al.
Pubblicazione: (2023)
Towards Foundation Models for 3D Scene Understanding: Instance-Aware Self-Supervised Learning for Point Clouds
di: Yang, Bin, et al.
Pubblicazione: (2026)
di: Yang, Bin, et al.
Pubblicazione: (2026)
Instantaneous Perception of Moving Objects in 3D
di: Liu, Di, et al.
Pubblicazione: (2024)
di: Liu, Di, et al.
Pubblicazione: (2024)
Object Placement for Anything
di: Gao, Bingjie, et al.
Pubblicazione: (2025)
di: Gao, Bingjie, et al.
Pubblicazione: (2025)
Score-Guided Diffusion for 3D Human Recovery
di: Stathopoulos, Anastasis, et al.
Pubblicazione: (2024)
di: Stathopoulos, Anastasis, et al.
Pubblicazione: (2024)
Geometry-Aware Diffusion Models for Multiview Scene Inpainting
di: Salimi, Ahmad, et al.
Pubblicazione: (2025)
di: Salimi, Ahmad, et al.
Pubblicazione: (2025)
DiffPop: Plausibility-Guided Object Placement Diffusion for Image Composition
di: Liu, Jiacheng, et al.
Pubblicazione: (2024)
di: Liu, Jiacheng, et al.
Pubblicazione: (2024)
O$^2$-Recon: Completing 3D Reconstruction of Occluded Objects in the Scene with a Pre-trained 2D Diffusion Model
di: Hu, Yubin, et al.
Pubblicazione: (2023)
di: Hu, Yubin, et al.
Pubblicazione: (2023)
Object Style Diffusion for Generalized Object Detection in Urban Scene
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
Scene-Conditional 3D Object Stylization and Composition
di: Zhou, Jinghao, et al.
Pubblicazione: (2023)
di: Zhou, Jinghao, et al.
Pubblicazione: (2023)
Layout Agnostic Scene Text Image Synthesis with Diffusion Models
di: Zhangli, Qilong, et al.
Pubblicazione: (2024)
di: Zhangli, Qilong, et al.
Pubblicazione: (2024)
VideoScene: Distilling Video Diffusion Model to Generate 3D Scenes in One Step
di: Wang, Hanyang, et al.
Pubblicazione: (2025)
di: Wang, Hanyang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Scene-Aware Location Modeling for Data Augmentation in Automotive Object Detection
di: Petersen, Jens, et al.
Pubblicazione: (2025) -
Gaussian Splatting is an Effective Data Generator for 3D Object Detection
di: Zanjani, Farhad G., et al.
Pubblicazione: (2025) -
Imagining the Unseen: Generative Location Modeling for Object Placement
di: Yun, Jooyeol, et al.
Pubblicazione: (2024) -
Hybrid Gaussian Splatting for Novel Urban View Synthesis
di: Omran, Mohamed, et al.
Pubblicazione: (2025) -
ReHyAt: Recurrent Hybrid Attention for Video Diffusion Transformers
di: Ghafoorian, Mohsen, et al.
Pubblicazione: (2026)