SceneGraphGrounder: Zero-Shot 3D Visual Grounding via Structured Scene Graph Matching
Fuente:
arXiv
Saved in:
| Main Authors: | Sun, Xuefei, Zhang, Xujia, Crowe, Brendan, Albin, Doncey, Heckman, Christoffer |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Octree Diffusion for Semantic Scene Generation and Completion
by: Zhang, Xujia, et al.
Published: (2025)
by: Zhang, Xujia, et al.
Published: (2025)
SceneSense: Diffusion Models for 3D Occupancy Synthesis from Partial Observation
by: Reed, Alec, et al.
Published: (2024)
by: Reed, Alec, et al.
Published: (2024)
VLM-Grounder: A VLM Agent for Zero-Shot 3D Visual Grounding
by: Xu, Runsen, et al.
Published: (2024)
by: Xu, Runsen, et al.
Published: (2024)
Weather-Robust Scene Semantics with Vision-Aligned 4D Radar
by: Hamilton, Kali, et al.
Published: (2026)
by: Hamilton, Kali, et al.
Published: (2026)
Spatial-LLaVA: Enhancing Large Language Models with Spatial Referring Expressions for Visual Understanding
by: Sun, Xuefei, et al.
Published: (2025)
by: Sun, Xuefei, et al.
Published: (2025)
AgentGrounder: Zero-Shot 3D Visual Pointcloud Grounding using Multimodal Language Models
by: Huynh, Cuong, et al.
Published: (2026)
by: Huynh, Cuong, et al.
Published: (2026)
Belief Consistency Between Foundation-Model Evidence and Geometric Perception in Persistent Robotic Maps
by: Heckman, Christoffer, et al.
Published: (2026)
by: Heckman, Christoffer, et al.
Published: (2026)
MSGNav: Unleashing the Power of Multi-modal 3D Scene Graph for Zero-Shot Embodied Navigation
by: Huang, Xun, et al.
Published: (2025)
by: Huang, Xun, et al.
Published: (2025)
DGSG-Mind: Dynamic 3D Gaussian Scene Graphs for Long-Term Scene Understanding and Grounding
by: Ge, Luzhou, et al.
Published: (2026)
by: Ge, Luzhou, et al.
Published: (2026)
ZING-3D: Zero-shot Incremental 3D Scene Graphs via Vision-Language Models
by: Saxena, Pranav, et al.
Published: (2025)
by: Saxena, Pranav, et al.
Published: (2025)
UniGround: Universal 3D Visual Grounding via Training-Free Scene Parsing
by: Zhang, Jiaxi, et al.
Published: (2026)
by: Zhang, Jiaxi, et al.
Published: (2026)
CogExplore: Contextual Exploration with Language-Encoded Environment Representations
by: Biggie, Harel, et al.
Published: (2024)
by: Biggie, Harel, et al.
Published: (2024)
SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation
by: Zhang, Jiwen, et al.
Published: (2026)
by: Zhang, Jiwen, et al.
Published: (2026)
FunGraph: Functionality Aware 3D Scene Graphs for Language-Prompted Scene Interaction
by: Rotondi, Dennis, et al.
Published: (2025)
by: Rotondi, Dennis, et al.
Published: (2025)
ZeroSCD: Zero-Shot Street Scene Change Detection
by: Kannan, Shyam Sundar, et al.
Published: (2024)
by: Kannan, Shyam Sundar, et al.
Published: (2024)
SeeGround: See and Ground for Zero-Shot Open-Vocabulary 3D Visual Grounding
by: Li, Rong, et al.
Published: (2024)
by: Li, Rong, et al.
Published: (2024)
SG-PGM: Partial Graph Matching Network with Semantic Geometric Fusion for 3D Scene Graph Alignment and Its Downstream Tasks
by: Xie, Yaxu, et al.
Published: (2024)
by: Xie, Yaxu, et al.
Published: (2024)
Estimating Commonsense Scene Composition on Belief Scene Graphs
by: Saucedo, Mario A. V., et al.
Published: (2025)
by: Saucedo, Mario A. V., et al.
Published: (2025)
SG-Nav: Online 3D Scene Graph Prompting for LLM-based Zero-shot Object Navigation
by: Yin, Hang, et al.
Published: (2024)
by: Yin, Hang, et al.
Published: (2024)
Zero-Shot 3D Visual Grounding from Vision-Language Models
by: Li, Rong, et al.
Published: (2025)
by: Li, Rong, et al.
Published: (2025)
KeySG: Hierarchical Keyframe-Based 3D Scene Graphs
by: Werby, Abdelrhman, et al.
Published: (2025)
by: Werby, Abdelrhman, et al.
Published: (2025)
Pandora: Articulated 3D Scene Graphs from Egocentric Vision
by: Yu, Alan, et al.
Published: (2026)
by: Yu, Alan, et al.
Published: (2026)
RAG-3DSG: Enhancing 3D Scene Graphs with Re-Shot Guided Retrieval-Augmented Generation
by: Chang, Yue, et al.
Published: (2026)
by: Chang, Yue, et al.
Published: (2026)
SpatialAnt: Autonomous Zero-Shot Robot Navigation via Active Scene Reconstruction and Visual Anticipation
by: Zhang, Jiwen, et al.
Published: (2026)
by: Zhang, Jiwen, et al.
Published: (2026)
OpenSGA: Efficient 3D Scene Graph Alignment in the Open World
by: Chen, Gang, et al.
Published: (2026)
by: Chen, Gang, et al.
Published: (2026)
Rheos: Modelling Continuous Motion Dynamics in Hierarchical 3D Scene Graphs
by: Catalano, Iacopo, et al.
Published: (2026)
by: Catalano, Iacopo, et al.
Published: (2026)
SGAligner++: Cross-Modal Language-Aided 3D Scene Graph Alignment
by: Singh, Binod, et al.
Published: (2025)
by: Singh, Binod, et al.
Published: (2025)
Belief Scene Graphs: Expanding Partial Scenes with Objects through Computation of Expectation
by: Saucedo, Mario A. V., et al.
Published: (2024)
by: Saucedo, Mario A. V., et al.
Published: (2024)
CU-Multi: A Dataset for Multi-Robot Data Association
by: Albin, Doncey, et al.
Published: (2025)
by: Albin, Doncey, et al.
Published: (2025)
View-on-Graph: Zero-shot 3D Visual Grounding via Vision-Language Reasoning on Scene Graphs
by: Liu, Yuanyuan, et al.
Published: (2025)
by: Liu, Yuanyuan, et al.
Published: (2025)
PanoGrounder: Bridging 2D and 3D with Panoramic Scene Representations for VLM-based 3D Visual Grounding
by: Jung, Seongmin, et al.
Published: (2025)
by: Jung, Seongmin, et al.
Published: (2025)
Hierarchical and Holistic Open-Vocabulary Functional 3D Scene Graphs for Indoor Spaces
by: Hu, Xinggang, et al.
Published: (2026)
by: Hu, Xinggang, et al.
Published: (2026)
PACA: Perspective-Aware Cross-Attention Representation for Zero-Shot Scene Rearrangement
by: Jin, Shutong, et al.
Published: (2024)
by: Jin, Shutong, et al.
Published: (2024)
Have We Scene It All? Scene Graph-Aware Deep Point Cloud Compression
by: Stathoulopoulos, Nikolaos, et al.
Published: (2025)
by: Stathoulopoulos, Nikolaos, et al.
Published: (2025)
SGFormer: Satellite-Ground Fusion for 3D Semantic Scene Completion
by: Guo, Xiyue, et al.
Published: (2025)
by: Guo, Xiyue, et al.
Published: (2025)
vS-Graphs: Tightly Coupling Visual SLAM and 3D Scene Graphs Exploiting Hierarchical Scene Understanding
by: Tourani, Ali, et al.
Published: (2025)
by: Tourani, Ali, et al.
Published: (2025)
Articulated 3D Scene Graphs for Open-World Mobile Manipulation
by: Büchner, Martin, et al.
Published: (2026)
by: Büchner, Martin, et al.
Published: (2026)
Lost & Found: Tracking Changes from Egocentric Observations in 3D Dynamic Scene Graphs
by: Behrens, Tjark, et al.
Published: (2024)
by: Behrens, Tjark, et al.
Published: (2024)
Hierarchical Open-Vocabulary 3D Scene Graphs for Language-Grounded Robot Navigation
by: Werby, Abdelrhman, et al.
Published: (2024)
by: Werby, Abdelrhman, et al.
Published: (2024)
Online Diffusion-Based 3D Occupancy Prediction at the Frontier with Probabilistic Map Reconciliation
by: Reed, Alec, et al.
Published: (2024)
by: Reed, Alec, et al.
Published: (2024)
Similar Items
-
Octree Diffusion for Semantic Scene Generation and Completion
by: Zhang, Xujia, et al.
Published: (2025) -
SceneSense: Diffusion Models for 3D Occupancy Synthesis from Partial Observation
by: Reed, Alec, et al.
Published: (2024) -
VLM-Grounder: A VLM Agent for Zero-Shot 3D Visual Grounding
by: Xu, Runsen, et al.
Published: (2024) -
Weather-Robust Scene Semantics with Vision-Aligned 4D Radar
by: Hamilton, Kali, et al.
Published: (2026) -
Spatial-LLaVA: Enhancing Large Language Models with Spatial Referring Expressions for Visual Understanding
by: Sun, Xuefei, et al.
Published: (2025)