Object Navigation with Structure-Semantic Reasoning-Based Multi-level Map and Multimodal Decision-Making LLM
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yan, Chongshang, He, Jiaxuan, Li, Delun, Yang, Yi, Song, Wenjie |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SemSight: Probabilistic Bird's-Eye-View Prediction of Multi-Level Scene Semantics for Navigation
par: He, Jiaxuan, et autres
Publié: (2025)
par: He, Jiaxuan, et autres
Publié: (2025)
Deep Learning-Based Multi-Modal Fusion for Robust Robot Perception and Navigation
par: Lai, Delun, et autres
Publié: (2025)
par: Lai, Delun, et autres
Publié: (2025)
SSR-ZSON: Zero-Shot Object Navigation via Spatial-Semantic Relations within a Hierarchical Exploration Framework
par: Meng, Xiangyi, et autres
Publié: (2025)
par: Meng, Xiangyi, et autres
Publié: (2025)
TP-MDDN: Task-Preferenced Multi-Demand-Driven Navigation with Autonomous Decision-Making
par: Li, Shanshan, et autres
Publié: (2025)
par: Li, Shanshan, et autres
Publié: (2025)
DualMap: Online Open-Vocabulary Semantic Mapping for Natural Language Navigation in Dynamic Changing Scenes
par: Jiang, Jiajun, et autres
Publié: (2025)
par: Jiang, Jiajun, et autres
Publié: (2025)
FOM-Nav: Frontier-Object Maps for Object Goal Navigation
par: Chabal, Thomas, et autres
Publié: (2025)
par: Chabal, Thomas, et autres
Publié: (2025)
Multi-GraspLLM: A Multimodal LLM for Multi-Hand Semantic Guided Grasp Generation
par: Li, Haosheng, et autres
Publié: (2024)
par: Li, Haosheng, et autres
Publié: (2024)
Real-Time Metric-Semantic Mapping for Autonomous Navigation in Outdoor Environments
par: Jiao, Jianhao, et autres
Publié: (2024)
par: Jiao, Jianhao, et autres
Publié: (2024)
MLFM: Multi-Layered Feature Maps for Richer Language Understanding in Zero-Shot Semantic Navigation
par: Raychaudhuri, Sonia, et autres
Publié: (2025)
par: Raychaudhuri, Sonia, et autres
Publié: (2025)
Visual Prompt Based Reasoning for Offroad Mapping using Multimodal LLMs
par: Nasser, Abdelmoamen, et autres
Publié: (2026)
par: Nasser, Abdelmoamen, et autres
Publié: (2026)
Hierarchical Semantic-Augmented Navigation: Optimal Transport and Graph-Driven Reasoning for Vision-Language Navigation
par: Fang, Xiang, et autres
Publié: (2026)
par: Fang, Xiang, et autres
Publié: (2026)
ReasonNavi: Human-Inspired Global Map Reasoning for Zero-Shot Embodied Navigation
par: Ao, Yuzhuo, et autres
Publié: (2026)
par: Ao, Yuzhuo, et autres
Publié: (2026)
Tag Map: A Text-Based Map for Spatial Reasoning and Navigation with Large Language Models
par: Zhang, Mike, et autres
Publié: (2024)
par: Zhang, Mike, et autres
Publié: (2024)
ConsistNav: Closing the Action Consistency Gap in Zero-Shot Object Navigation with Semantic Executive Control
par: Wang, Haosen, et autres
Publié: (2026)
par: Wang, Haosen, et autres
Publié: (2026)
MK-Pose: Category-Level Object Pose Estimation via Multimodal-Based Keypoint Learning
par: Yang, Yifan, et autres
Publié: (2025)
par: Yang, Yifan, et autres
Publié: (2025)
Mapping High-level Semantic Regions in Indoor Environments without Object Recognition
par: Bigazzi, Roberto, et autres
Publié: (2024)
par: Bigazzi, Roberto, et autres
Publié: (2024)
Active 6D Pose Estimation for Textureless Objects using Multi-View RGB Frames
par: Yang, Jun, et autres
Publié: (2025)
par: Yang, Jun, et autres
Publié: (2025)
Aligning Knowledge Graph with Visual Perception for Object-goal Navigation
par: Xu, Nuo, et autres
Publié: (2024)
par: Xu, Nuo, et autres
Publié: (2024)
AERR-Nav: Adaptive Exploration-Recovery-Reminiscing Strategy for Zero-Shot Object Navigation
par: Huang, Jingzhi, et autres
Publié: (2026)
par: Huang, Jingzhi, et autres
Publié: (2026)
FantasyVLN: Unified Multimodal Chain-of-Thought Reasoning for Vision-Language Navigation
par: Zuo, Jing, et autres
Publié: (2026)
par: Zuo, Jing, et autres
Publié: (2026)
Distilling LLM Prior to Flow Model for Generalizable Agent's Imagination in Object Goal Navigation
par: Li, Badi, et autres
Publié: (2025)
par: Li, Badi, et autres
Publié: (2025)
MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments
par: Liu, Zhuonan, et autres
Publié: (2025)
par: Liu, Zhuonan, et autres
Publié: (2025)
Semantic Object-level Modeling for Robust Visual Camera Relocalization
par: Zhu, Yifan, et autres
Publié: (2024)
par: Zhu, Yifan, et autres
Publié: (2024)
CAMON: Cooperative Agents for Multi-Object Navigation with LLM-based Conversations
par: Wu, Pengying, et autres
Publié: (2024)
par: Wu, Pengying, et autres
Publié: (2024)
Multimodal LLM Guided Exploration and Active Mapping using Fisher Information
par: Jiang, Wen, et autres
Publié: (2024)
par: Jiang, Wen, et autres
Publié: (2024)
Enhancing Vision-Language Navigation with Multimodal Event Knowledge from Real-World Indoor Tour Videos
par: Xu, Haoxuan, et autres
Publié: (2026)
par: Xu, Haoxuan, et autres
Publié: (2026)
M3DMap: Object-aware Multimodal 3D Mapping for Dynamic Environments
par: Yudin, Dmitry
Publié: (2025)
par: Yudin, Dmitry
Publié: (2025)
Language-Based Augmentation to Address Shortcut Learning in Object Goal Navigation
par: Hoftijzer, Dennis, et autres
Publié: (2024)
par: Hoftijzer, Dennis, et autres
Publié: (2024)
Understanding while Exploring: Semantics-driven Active Mapping
par: Chen, Liyan, et autres
Publié: (2025)
par: Chen, Liyan, et autres
Publié: (2025)
DOPE: Dual Object Perception-Enhancement Network for Vision-and-Language Navigation
par: Yu, Yinfeng, et autres
Publié: (2025)
par: Yu, Yinfeng, et autres
Publié: (2025)
MapBERT: Bitwise Masked Modeling for Real-Time Semantic Mapping Generation
par: Deng, Yijie, et autres
Publié: (2025)
par: Deng, Yijie, et autres
Publié: (2025)
Open-Set 3D Semantic Instance Maps for Vision Language Navigation -- O3D-SIM
par: Nanwani, Laksh, et autres
Publié: (2024)
par: Nanwani, Laksh, et autres
Publié: (2024)
LOC-ZSON: Language-driven Object-Centric Zero-Shot Object Retrieval and Navigation
par: Guan, Tianrui, et autres
Publié: (2024)
par: Guan, Tianrui, et autres
Publié: (2024)
Reason--Imagine--Act: Closed-Loop LLM Decision Making with World Models for Autonomous Driving
par: Sun, Zhengqi, et autres
Publié: (2026)
par: Sun, Zhengqi, et autres
Publié: (2026)
Autonomous Navigation of Cloud-Controlled Quadcopters in Confined Spaces Using Multi-Modal Perception and LLM-Driven High Semantic Reasoning
par: Ahmmad, Shoaib, et autres
Publié: (2025)
par: Ahmmad, Shoaib, et autres
Publié: (2025)
LiteVLoc: Map-Lite Visual Localization for Image Goal Navigation
par: Jiao, Jianhao, et autres
Publié: (2024)
par: Jiao, Jianhao, et autres
Publié: (2024)
Decision-Driven Semantic Object Exploration for Legged Robots via Confidence-Calibrated Perception and Topological Subgoal Selection
par: Zhao, Guoyang, et autres
Publié: (2025)
par: Zhao, Guoyang, et autres
Publié: (2025)
Monocular Localization with Semantics Map for Autonomous Vehicles
par: Wan, Jixiang, et autres
Publié: (2024)
par: Wan, Jixiang, et autres
Publié: (2024)
Visual Semantic Navigation with Real Robots
par: Gutiérrez-Álvarez, Carlos, et autres
Publié: (2023)
par: Gutiérrez-Álvarez, Carlos, et autres
Publié: (2023)
Rule-VLN: Bridging Perception and Compliance via Semantic Reasoning and Geometric Rectification
par: Wen, Jiawen, et autres
Publié: (2026)
par: Wen, Jiawen, et autres
Publié: (2026)
Documents similaires
-
SemSight: Probabilistic Bird's-Eye-View Prediction of Multi-Level Scene Semantics for Navigation
par: He, Jiaxuan, et autres
Publié: (2025) -
Deep Learning-Based Multi-Modal Fusion for Robust Robot Perception and Navigation
par: Lai, Delun, et autres
Publié: (2025) -
SSR-ZSON: Zero-Shot Object Navigation via Spatial-Semantic Relations within a Hierarchical Exploration Framework
par: Meng, Xiangyi, et autres
Publié: (2025) -
TP-MDDN: Task-Preferenced Multi-Demand-Driven Navigation with Autonomous Decision-Making
par: Li, Shanshan, et autres
Publié: (2025) -
DualMap: Online Open-Vocabulary Semantic Mapping for Natural Language Navigation in Dynamic Changing Scenes
par: Jiang, Jiajun, et autres
Publié: (2025)