Think before Go: Hierarchical Reasoning for Image-goal Navigation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Pengna, Wu, Kangyi, Xu, Shaoqing, Li, Fang, Zhao, Lin, Chen, Long, Yang, Zhi-Xin, Zheng, Nanning |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation
par: Li, Pengna, et autres
Publié: (2026)
par: Li, Pengna, et autres
Publié: (2026)
HiMemVLN: Enhancing Reliability of Open-Source Zero-Shot Vision-and-Language Navigation with Hierarchical Memory System
par: Lyu, Kailin, et autres
Publié: (2026)
par: Lyu, Kailin, et autres
Publié: (2026)
REGNav: Room Expert Guided Image-Goal Navigation
par: Li, Pengna, et autres
Publié: (2025)
par: Li, Pengna, et autres
Publié: (2025)
MORN: Metacognitive Object-Goal Regulation for Resource-Rational Long-Horizon Navigation
par: Lin, Xi, et autres
Publié: (2026)
par: Lin, Xi, et autres
Publié: (2026)
Optimal-Horizon Social Robot Navigation in Heterogeneous Crowds
par: Shi, Jiamin, et autres
Publié: (2026)
par: Shi, Jiamin, et autres
Publié: (2026)
BEINGS: Bayesian Embodied Image-goal Navigation with Gaussian Splatting
par: Meng, Wugang, et autres
Publié: (2024)
par: Meng, Wugang, et autres
Publié: (2024)
Progress-Think: Semantic Progress Reasoning for Vision-Language Navigation
par: Wang, Shuo, et autres
Publié: (2025)
par: Wang, Shuo, et autres
Publié: (2025)
DVGT-2: Vision-Geometry-Action Model for Autonomous Driving at Scale
par: Zuo, Sicheng, et autres
Publié: (2026)
par: Zuo, Sicheng, et autres
Publié: (2026)
Aux-Think: Exploring Reasoning Strategies for Data-Efficient Vision-Language Navigation
par: Wang, Shuo, et autres
Publié: (2025)
par: Wang, Shuo, et autres
Publié: (2025)
Aligning Knowledge Graph with Visual Perception for Object-goal Navigation
par: Xu, Nuo, et autres
Publié: (2024)
par: Xu, Nuo, et autres
Publié: (2024)
DVGT: Driving Visual Geometry Transformer
par: Zuo, Sicheng, et autres
Publié: (2025)
par: Zuo, Sicheng, et autres
Publié: (2025)
120 Minutes and a Laptop: Minimalist Image-goal Navigation via Unsupervised Exploration and Offline RL
par: Liu, Xiaoming, et autres
Publié: (2026)
par: Liu, Xiaoming, et autres
Publié: (2026)
Hyperbolic Multiview Pretraining for Robotic Manipulation
par: Yang, Jin, et autres
Publié: (2026)
par: Yang, Jin, et autres
Publié: (2026)
Hierarchical Semantic-Augmented Navigation: Optimal Transport and Graph-Driven Reasoning for Vision-Language Navigation
par: Fang, Xiang, et autres
Publié: (2026)
par: Fang, Xiang, et autres
Publié: (2026)
IGL-Nav: Incremental 3D Gaussian Localization for Image-goal Navigation
par: Guo, Wenxuan, et autres
Publié: (2025)
par: Guo, Wenxuan, et autres
Publié: (2025)
LiveVLN: Breaking the Stop-and-Go Loop in Vision-Language Navigation
par: Wang, Xiangchen, et autres
Publié: (2026)
par: Wang, Xiangchen, et autres
Publié: (2026)
Dual-Control Frequency-Aware Diffusion Model for Depth-Dependent Optical Microrobot Microscopy Image Generation
par: Wei, Lan, et autres
Publié: (2026)
par: Wei, Lan, et autres
Publié: (2026)
Dual-Anchoring: Addressing State Drift in Vision-Language Navigation
par: Wu, Kangyi, et autres
Publié: (2026)
par: Wu, Kangyi, et autres
Publié: (2026)
Think, Remember, Navigate: Zero-Shot Object-Goal Navigation with VLM-Powered Reasoning
par: Habibpour, Mobin, et autres
Publié: (2025)
par: Habibpour, Mobin, et autres
Publié: (2025)
HCSG: Human-Centric Semantic-Geometric Reasoning for Vision-Language Navigation
par: Xu, Haoxuan, et autres
Publié: (2026)
par: Xu, Haoxuan, et autres
Publié: (2026)
CompassNav: Steering From Path Imitation To Decision Understanding In Navigation
par: Li, LinFeng, et autres
Publié: (2025)
par: Li, LinFeng, et autres
Publié: (2025)
LagMemo: Language 3D Gaussian Splatting Memory for Multi-modal Open-vocabulary Multi-goal Visual Navigation
par: Zhou, Haotian, et autres
Publié: (2025)
par: Zhou, Haotian, et autres
Publié: (2025)
PlaneHEC: Efficient Hand-Eye Calibration for Multi-view Robotic Arm via Any Point Cloud Plane Detection
par: Wang, Ye, et autres
Publié: (2025)
par: Wang, Ye, et autres
Publié: (2025)
T-araVLN: Translator for Agricultural Robotic Agents on Vision-and-Language Navigation
par: Zhao, Xiaobei, et autres
Publié: (2025)
par: Zhao, Xiaobei, et autres
Publié: (2025)
Hierarchical Language Models for Semantic Navigation and Manipulation in an Aerial-Ground Robotic System
par: Liu, Haokun, et autres
Publié: (2025)
par: Liu, Haokun, et autres
Publié: (2025)
GeoNav: Empowering MLLMs with dual-scale geospatial reasoning for language-goal aerial navigation
par: Xu, Haotian, et autres
Publié: (2025)
par: Xu, Haotian, et autres
Publié: (2025)
MDE-AgriVLN: Agricultural Vision-and-Language Navigation with Monocular Depth Estimation
par: Zhao, Xiaobei, et autres
Publié: (2025)
par: Zhao, Xiaobei, et autres
Publié: (2025)
AdaNav: Adaptive Reasoning with Uncertainty for Vision-Language Navigation
par: Ding, Xin, et autres
Publié: (2025)
par: Ding, Xin, et autres
Publié: (2025)
An Efficient Insect-inspired Approach for Visual Point-goal Navigation
par: Lu, Yihe, et autres
Publié: (2026)
par: Lu, Yihe, et autres
Publié: (2026)
IMAC-AgriVLN: Can Agricultural Vision-and-Language Navigation Agents be Aware of Instruction Mistakes?
par: Zhao, Xiaobei, et autres
Publié: (2026)
par: Zhao, Xiaobei, et autres
Publié: (2026)
Hydra-Nav: Object Navigation via Adaptive Dual-Process Reasoning
par: Wang, Zixuan, et autres
Publié: (2026)
par: Wang, Zixuan, et autres
Publié: (2026)
CLASH: Collaborative Large-Small Hierarchical Framework for Continuous Vision-and-Language Navigation
par: Wang, Liuyi, et autres
Publié: (2025)
par: Wang, Liuyi, et autres
Publié: (2025)
Thinking in Text and Images: Interleaved Vision--Language Reasoning Traces for Long-Horizon Robot Manipulation
par: Liu, Jinkun, et autres
Publié: (2026)
par: Liu, Jinkun, et autres
Publié: (2026)
HEROS: Hierarchical Exploration with Online Subregion Updating for 3D Environment Coverage
par: Long, Shijun, et autres
Publié: (2024)
par: Long, Shijun, et autres
Publié: (2024)
HPHS: Hierarchical Planning based on Hybrid Frontier Sampling for Unknown Environments Exploration
par: Long, Shijun, et autres
Publié: (2024)
par: Long, Shijun, et autres
Publié: (2024)
P$^{3}$Nav: End-to-End Perception, Prediction and Planning for Vision-and-Language Navigation
par: Li, Tianfu, et autres
Publié: (2026)
par: Li, Tianfu, et autres
Publié: (2026)
DecoVLN: Decoupling Observation, Reasoning, and Correction for Vision-and-Language Navigation
par: Xin, Zihao, et autres
Publié: (2026)
par: Xin, Zihao, et autres
Publié: (2026)
One Agent to Guide Them All: Empowering MLLMs for Vision-and-Language Navigation via Explicit World Representation
par: Li, Zerui, et autres
Publié: (2026)
par: Li, Zerui, et autres
Publié: (2026)
DRL-TH: Jointly Utilizing Temporal Graph Attention and Hierarchical Fusion for UGV Navigation in Crowded Environments
par: Li, Ruitong, et autres
Publié: (2025)
par: Li, Ruitong, et autres
Publié: (2025)
FSR-VLN: Fast and Slow Reasoning for Vision-Language Navigation with Hierarchical Multi-modal Scene Graph
par: Zhou, Xiaolin, et autres
Publié: (2025)
par: Zhou, Xiaolin, et autres
Publié: (2025)
Documents similaires
-
SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation
par: Li, Pengna, et autres
Publié: (2026) -
HiMemVLN: Enhancing Reliability of Open-Source Zero-Shot Vision-and-Language Navigation with Hierarchical Memory System
par: Lyu, Kailin, et autres
Publié: (2026) -
REGNav: Room Expert Guided Image-Goal Navigation
par: Li, Pengna, et autres
Publié: (2025) -
MORN: Metacognitive Object-Goal Regulation for Resource-Rational Long-Horizon Navigation
par: Lin, Xi, et autres
Publié: (2026) -
Optimal-Horizon Social Robot Navigation in Heterogeneous Crowds
par: Shi, Jiamin, et autres
Publié: (2026)