SpatialReasoner: Active Perception for Large-Scale 3D Scene Understanding
Fuente:
arXiv
Guardado en:
| Autores principales: | Zheng, Hongpei, Li, Shijie, Li, Yanran, Yin, Hujun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Reg3D: Reconstructive Geometry Instruction Tuning for 3D Scene Understanding
por: Zheng, Hongpei, et al.
Publicado: (2025)
por: Zheng, Hongpei, et al.
Publicado: (2025)
SpatialReasoner: Towards Explicit and Generalizable 3D Spatial Reasoning
por: Ma, Wufei, et al.
Publicado: (2025)
por: Ma, Wufei, et al.
Publicado: (2025)
Geometric Prior-Guided Neural Implicit Surface Reconstruction in the Wild
por: Xiang, Lintao, et al.
Publicado: (2025)
por: Xiang, Lintao, et al.
Publicado: (2025)
PointGS: Point Attention-Aware Sparse View Synthesis with Gaussian Splatting
por: Xiang, Lintao, et al.
Publicado: (2025)
por: Xiang, Lintao, et al.
Publicado: (2025)
IntentionNav: A Benchmark for Intent-Driven Object Navigation from Implicit Human Instruction
por: Qian, Lin, et al.
Publicado: (2026)
por: Qian, Lin, et al.
Publicado: (2026)
NIS-SLAM: Neural Implicit Semantic RGB-D SLAM for 3D Consistent Scene Understanding
por: Zhai, Hongjia, et al.
Publicado: (2024)
por: Zhai, Hongjia, et al.
Publicado: (2024)
Enhancing MLLM Spatial Understanding via Active 3D Scene Exploration for Multi-Perspective Reasoning
por: Chen, Jiahua, et al.
Publicado: (2026)
por: Chen, Jiahua, et al.
Publicado: (2026)
SURPRISE3D: A Dataset for Spatial Understanding and Reasoning in Complex 3D Scenes
por: Huang, Jiaxin, et al.
Publicado: (2025)
por: Huang, Jiaxin, et al.
Publicado: (2025)
Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances
por: Wang, Qirui, et al.
Publicado: (2026)
por: Wang, Qirui, et al.
Publicado: (2026)
3D-SceneDreamer: Text-Driven 3D-Consistent Scene Generation
por: Zhang, Frank, et al.
Publicado: (2024)
por: Zhang, Frank, et al.
Publicado: (2024)
SpatialStack: Layered Geometry-Language Fusion for 3D VLM Spatial Reasoning
por: Zhang, Jian, et al.
Publicado: (2026)
por: Zhang, Jian, et al.
Publicado: (2026)
GP-NeRF: Generalized Perception NeRF for Context-Aware 3D Scene Understanding
por: Li, Hao, et al.
Publicado: (2023)
por: Li, Hao, et al.
Publicado: (2023)
HMR3D: Hierarchical Multimodal Representation for 3D Scene Understanding with Large Vision-Language Model
por: Li, Chen, et al.
Publicado: (2025)
por: Li, Chen, et al.
Publicado: (2025)
Scene-R1: Video-Grounded Large Language Models for 3D Scene Reasoning without 3D Annotations
por: Yuan, Zhihao, et al.
Publicado: (2025)
por: Yuan, Zhihao, et al.
Publicado: (2025)
SpatialAct: Probing Spatial Reasoning-to-Action Capabilities of VLM Agents in 3D Scenes
por: Liu, Tianhui, et al.
Publicado: (2026)
por: Liu, Tianhui, et al.
Publicado: (2026)
HiScene: Creating Hierarchical 3D Scenes with Isometric View Generation
por: Dong, Wenqi, et al.
Publicado: (2025)
por: Dong, Wenqi, et al.
Publicado: (2025)
SGFormer: Satellite-Ground Fusion for 3D Semantic Scene Completion
por: Guo, Xiyue, et al.
Publicado: (2025)
por: Guo, Xiyue, et al.
Publicado: (2025)
InstaScene: Towards Complete 3D Instance Decomposition and Reconstruction from Cluttered Scenes
por: Yang, Zesong, et al.
Publicado: (2025)
por: Yang, Zesong, et al.
Publicado: (2025)
Leveraging 2D-VLM for Label-Free 3D Segmentation in Large-Scale Outdoor Scene Understanding
por: Nishimura, Toshihiko, et al.
Publicado: (2026)
por: Nishimura, Toshihiko, et al.
Publicado: (2026)
Intelligent Spatial Perception by Building Hierarchical 3D Scene Graphs for Indoor Scenarios with the Help of LLMs
por: Cheng, Yao, et al.
Publicado: (2025)
por: Cheng, Yao, et al.
Publicado: (2025)
COOPER: A Unified Model for Cooperative Perception and Reasoning in Spatial Intelligence
por: Zhang, Zefeng, et al.
Publicado: (2025)
por: Zhang, Zefeng, et al.
Publicado: (2025)
Masking Matters: Unlocking the Spatial Reasoning Capabilities of LLMs for 3D Scene-Language Understanding
por: Jeon, Yerim, et al.
Publicado: (2025)
por: Jeon, Yerim, et al.
Publicado: (2025)
A Large-Scale Multimodal Dataset and Benchmarks for Human Activity Scene Understanding and Reasoning
por: Jiang, Siyang, et al.
Publicado: (2025)
por: Jiang, Siyang, et al.
Publicado: (2025)
Boosting MLLM Spatial Reasoning with Geometrically Referenced 3D Scene Representations
por: Yuan, Jiangye, et al.
Publicado: (2026)
por: Yuan, Jiangye, et al.
Publicado: (2026)
3D-R1: Enhancing Reasoning in 3D VLMs for Unified Scene Understanding
por: Huang, Ting, et al.
Publicado: (2025)
por: Huang, Ting, et al.
Publicado: (2025)
SSCBench: A Large-Scale 3D Semantic Scene Completion Benchmark for Autonomous Driving
por: Li, Yiming, et al.
Publicado: (2023)
por: Li, Yiming, et al.
Publicado: (2023)
S3R-GS: Streamlining the Pipeline for Large-Scale Street Scene Reconstruction
por: Zheng, Guangting, et al.
Publicado: (2025)
por: Zheng, Guangting, et al.
Publicado: (2025)
Open-Vocabulary Octree-Graph for 3D Scene Understanding
por: Wang, Zhigang, et al.
Publicado: (2024)
por: Wang, Zhigang, et al.
Publicado: (2024)
SAM-Guided Masked Token Prediction for 3D Scene Understanding
por: Chen, Zhimin, et al.
Publicado: (2024)
por: Chen, Zhimin, et al.
Publicado: (2024)
Generating Human Motion in 3D Scenes from Text Descriptions
por: Cen, Zhi, et al.
Publicado: (2024)
por: Cen, Zhi, et al.
Publicado: (2024)
CLEAR-IR: Clarity-Enhanced Active Reconstruction of Infrared Imagery
por: Shankar, Nathan, et al.
Publicado: (2025)
por: Shankar, Nathan, et al.
Publicado: (2025)
R2G: Reasoning to Ground in 3D Scenes
por: Li, Yixuan, et al.
Publicado: (2024)
por: Li, Yixuan, et al.
Publicado: (2024)
DSPNet: Dual-vision Scene Perception for Robust 3D Question Answering
por: Luo, Jingzhou, et al.
Publicado: (2025)
por: Luo, Jingzhou, et al.
Publicado: (2025)
IL3D: A Large-Scale Indoor Layout Dataset for LLM-Driven 3D Scene Generation
por: Zhou, Wenxu, et al.
Publicado: (2025)
por: Zhou, Wenxu, et al.
Publicado: (2025)
Embodied Intelligence for 3D Understanding: A Survey on 3D Scene Question Answering
por: Li, Zechuan, et al.
Publicado: (2025)
por: Li, Zechuan, et al.
Publicado: (2025)
3D Question Answering for City Scene Understanding
por: Sun, Penglei, et al.
Publicado: (2024)
por: Sun, Penglei, et al.
Publicado: (2024)
SpatialDreamer: Incentivizing Spatial Reasoning via Active Mental Imagery
por: Cao, Meng, et al.
Publicado: (2025)
por: Cao, Meng, et al.
Publicado: (2025)
SpatialCrafter: Unleashing the Imagination of Video Diffusion Models for Scene Reconstruction from Limited Observations
por: Zhang, Songchun, et al.
Publicado: (2025)
por: Zhang, Songchun, et al.
Publicado: (2025)
Spatial As Deep: Spatial CNN for Traffic Scene Understanding
por: Pan, Xingang, et al.
Publicado: (2017)
por: Pan, Xingang, et al.
Publicado: (2017)
A3R: Agentic Affordance Reasoning via Cross-Dimensional Evidence in 3D Gaussian Scenes
por: Li, Di, et al.
Publicado: (2026)
por: Li, Di, et al.
Publicado: (2026)
Ejemplares similares
-
Reg3D: Reconstructive Geometry Instruction Tuning for 3D Scene Understanding
por: Zheng, Hongpei, et al.
Publicado: (2025) -
SpatialReasoner: Towards Explicit and Generalizable 3D Spatial Reasoning
por: Ma, Wufei, et al.
Publicado: (2025) -
Geometric Prior-Guided Neural Implicit Surface Reconstruction in the Wild
por: Xiang, Lintao, et al.
Publicado: (2025) -
PointGS: Point Attention-Aware Sparse View Synthesis with Gaussian Splatting
por: Xiang, Lintao, et al.
Publicado: (2025) -
IntentionNav: A Benchmark for Intent-Driven Object Navigation from Implicit Human Instruction
por: Qian, Lin, et al.
Publicado: (2026)