Generation Models Know Space: Unleashing Implicit 3D Priors for Scene Understanding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Xianjin, Liang, Dingkang, Feng, Tianrui, Xia, Kui, Zhang, Yumeng, Li, Xiaofan, Tan, Xiao, Bai, Xiang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PointTPA: Dynamic Network Parameter Adaptation for 3D Scene Understanding
par: Liu, Siyuan, et autres
Publié: (2026)
par: Liu, Siyuan, et autres
Publié: (2026)
DriVerse: Navigation World Model for Driving Simulation via Multimodal Trajectory Prompting and Motion Alignment
par: Li, Xiaofan, et autres
Publié: (2025)
par: Li, Xiaofan, et autres
Publié: (2025)
UniFuture: A 4D Driving World Model for Future Generation and Perception
par: Liang, Dingkang, et autres
Publié: (2025)
par: Liang, Dingkang, et autres
Publié: (2025)
From Prompts to Printable Models: Support-Effective 3D Generation via Offset Direct Preference Optimization
par: Wu, Chenming, et autres
Publié: (2025)
par: Wu, Chenming, et autres
Publié: (2025)
VLA-3D: A Dataset for 3D Semantic Scene Understanding and Navigation
par: Zhang, Haochen, et autres
Publié: (2024)
par: Zhang, Haochen, et autres
Publié: (2024)
Calib3D: Calibrating Model Preferences for Reliable 3D Scene Understanding
par: Kong, Lingdong, et autres
Publié: (2024)
par: Kong, Lingdong, et autres
Publié: (2024)
Language-Assisted 3D Scene Understanding
par: Wu, Yanmin, et autres
Publié: (2023)
par: Wu, Yanmin, et autres
Publié: (2023)
HERMES++: Toward a Unified Driving World Model for 3D Scene Understanding and Generation
par: Zhou, Xin, et autres
Publié: (2026)
par: Zhou, Xin, et autres
Publié: (2026)
DreamUp3D: Object-Centric Generative Models for Single-View 3D Scene Understanding and Real-to-Sim Transfer
par: Wu, Yizhe, et autres
Publié: (2024)
par: Wu, Yizhe, et autres
Publié: (2024)
OGScene3D: Incremental Open-Vocabulary 3D Gaussian Scene Graph Mapping for Scene Understanding
par: Zhu, Siting, et autres
Publié: (2026)
par: Zhu, Siting, et autres
Publié: (2026)
ISS Policy : Scalable Diffusion Policy with Implicit Scene Supervision
par: Xia, Wenlong, et autres
Publié: (2025)
par: Xia, Wenlong, et autres
Publié: (2025)
Collaborative Dynamic 3D Scene Graphs for Open-Vocabulary Urban Scene Understanding
par: Steinke, Tim, et autres
Publié: (2025)
par: Steinke, Tim, et autres
Publié: (2025)
Parameter-Efficient Fine-Tuning in Spectral Domain for Point Cloud Learning
par: Liang, Dingkang, et autres
Publié: (2024)
par: Liang, Dingkang, et autres
Publié: (2024)
UniScale: Unified Scale-Aware 3D Reconstruction for Multi-View Understanding via Prior Injection for Robotic Perception
par: Mahdavian, Mohammad, et autres
Publié: (2026)
par: Mahdavian, Mohammad, et autres
Publié: (2026)
A Unified Framework for 3D Scene Understanding
par: Xu, Wei, et autres
Publié: (2024)
par: Xu, Wei, et autres
Publié: (2024)
Exploring Bottlenecks in VLM-LLM Navigation: How 3D Scene Understanding Capability Impacts Zero-Shot VLN
par: Xia, Ziyi, et autres
Publié: (2026)
par: Xia, Ziyi, et autres
Publié: (2026)
Multi-Modal Data-Efficient 3D Scene Understanding for Autonomous Driving
par: Kong, Lingdong, et autres
Publié: (2024)
par: Kong, Lingdong, et autres
Publié: (2024)
Articulate3D: Holistic Understanding of 3D Scenes as Universal Scene Description
par: Halacheva, Anna-Maria, et autres
Publié: (2024)
par: Halacheva, Anna-Maria, et autres
Publié: (2024)
Unleashing Humanoid Reaching Potential via Real-world-Ready Skill Space
par: Zhang, Zhikai, et autres
Publié: (2025)
par: Zhang, Zhikai, et autres
Publié: (2025)
Towards Generalizable Robotic Manipulation in Dynamic Environments
par: Fang, Heng, et autres
Publié: (2026)
par: Fang, Heng, et autres
Publié: (2026)
MOSU: Autonomous Long-range Robot Navigation with Multi-modal Scene Understanding
par: Liang, Jing, et autres
Publié: (2025)
par: Liang, Jing, et autres
Publié: (2025)
MSGNav: Unleashing the Power of Multi-modal 3D Scene Graph for Zero-Shot Embodied Navigation
par: Huang, Xun, et autres
Publié: (2025)
par: Huang, Xun, et autres
Publié: (2025)
Online 3D Scene Reconstruction Using Neural Object Priors
par: Chabal, Thomas, et autres
Publié: (2025)
par: Chabal, Thomas, et autres
Publié: (2025)
SURPRISE3D: A Dataset for Spatial Understanding and Reasoning in Complex 3D Scenes
par: Huang, Jiaxin, et autres
Publié: (2025)
par: Huang, Jiaxin, et autres
Publié: (2025)
Fixed External Cameras as Common Prior Maps for Active 3D Scene Graph Generation
par: Modi, Giorgia, et autres
Publié: (2026)
par: Modi, Giorgia, et autres
Publié: (2026)
IRS: Instance-Level 3D Scene Graphs via Room Prior Guided LiDAR-Camera Fusion
par: Chen, Hongming, et autres
Publié: (2025)
par: Chen, Hongming, et autres
Publié: (2025)
PaCo-VLA: Passivity-Shielded Compliance Prior for Contact-Rich Vision-Language-Action Manipulation
par: Cao, Haofan, et autres
Publié: (2026)
par: Cao, Haofan, et autres
Publié: (2026)
Efficient Trajectory Generation Based on Traversable Planes in 3D Complex Architectural Spaces
par: Zhang, Mengke, et autres
Publié: (2025)
par: Zhang, Mengke, et autres
Publié: (2025)
Multi-Agent Monocular Dense SLAM With 3D Reconstruction Priors
par: Zhou, Yuchen, et autres
Publié: (2025)
par: Zhou, Yuchen, et autres
Publié: (2025)
Text-Scene: A Scene-to-Language Parsing Framework for 3D Scene Understanding
par: Li, Haoyuan, et autres
Publié: (2025)
par: Li, Haoyuan, et autres
Publié: (2025)
CATNIPS: Collision Avoidance Through Neural Implicit Probabilistic Scenes
par: Chen, Timothy, et autres
Publié: (2023)
par: Chen, Timothy, et autres
Publié: (2023)
Adaptive Prior Scene-Object SLAM for Dynamic Environments
par: Zhang, Haolan, et autres
Publié: (2025)
par: Zhang, Haolan, et autres
Publié: (2025)
HERMES: A Unified Self-Driving World Model for Simultaneous 3D Scene Understanding and Generation
par: Zhou, Xin, et autres
Publié: (2025)
par: Zhou, Xin, et autres
Publié: (2025)
Genie 4D: Semantic-Prior-Guided 4D Dynamic Scene Reconstruction
par: Yang, Yiru, et autres
Publié: (2026)
par: Yang, Yiru, et autres
Publié: (2026)
Semantic2D: Enabling Semantic Scene Understanding with 2D Lidar Alone
par: Xie, Zhanteng, et autres
Publié: (2024)
par: Xie, Zhanteng, et autres
Publié: (2024)
UniScene: Multi-Camera Unified Pre-training via 3D Scene Reconstruction for Autonomous Driving
par: Min, Chen, et autres
Publié: (2023)
par: Min, Chen, et autres
Publié: (2023)
Human-Like Implicit Intention Expression for Autonomous Driving Motion Planning: A Method Based on Learning Human Intention Priors
par: Liu, Jiaqi, et autres
Publié: (2023)
par: Liu, Jiaqi, et autres
Publié: (2023)
PRISM: Preference Refinement via Implicit Scene Modeling for 3D Vision-Language Preference-Based Reinforcement Learning
par: Sun, Yirong, et autres
Publié: (2025)
par: Sun, Yirong, et autres
Publié: (2025)
Implicit Articulated Robot Morphology Modeling with Configuration Space Neural Signed Distance Functions
par: Chen, Yiting, et autres
Publié: (2023)
par: Chen, Yiting, et autres
Publié: (2023)
Autonomous Implicit Indoor Scene Reconstruction with Frontier Exploration
par: Zeng, Jing, et autres
Publié: (2024)
par: Zeng, Jing, et autres
Publié: (2024)
Documents similaires
-
PointTPA: Dynamic Network Parameter Adaptation for 3D Scene Understanding
par: Liu, Siyuan, et autres
Publié: (2026) -
DriVerse: Navigation World Model for Driving Simulation via Multimodal Trajectory Prompting and Motion Alignment
par: Li, Xiaofan, et autres
Publié: (2025) -
UniFuture: A 4D Driving World Model for Future Generation and Perception
par: Liang, Dingkang, et autres
Publié: (2025) -
From Prompts to Printable Models: Support-Effective 3D Generation via Offset Direct Preference Optimization
par: Wu, Chenming, et autres
Publié: (2025) -
VLA-3D: A Dataset for 3D Semantic Scene Understanding and Navigation
par: Zhang, Haochen, et autres
Publié: (2024)