Tag Map: A Text-Based Map for Spatial Reasoning and Navigation with Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Mike, Qu, Kaixian, Patil, Vaishakh, Cadena, Cesar, Hutter, Marco |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MapDream: Task-Driven Map Learning for Vision-Language Navigation
di: Lian, Guoxin, et al.
Pubblicazione: (2026)
di: Lian, Guoxin, et al.
Pubblicazione: (2026)
MapGPT: Map-Guided Prompting with Adaptive Path Planning for Vision-and-Language Navigation
di: Chen, Jiaqi, et al.
Pubblicazione: (2024)
di: Chen, Jiaqi, et al.
Pubblicazione: (2024)
Object Navigation with Structure-Semantic Reasoning-Based Multi-level Map and Multimodal Decision-Making LLM
di: Yan, Chongshang, et al.
Pubblicazione: (2025)
di: Yan, Chongshang, et al.
Pubblicazione: (2025)
DiskChunGS: Large-Scale 3D Gaussian SLAM Through Chunk-Based Memory Management
di: Feldmann, Casimir, et al.
Pubblicazione: (2025)
di: Feldmann, Casimir, et al.
Pubblicazione: (2025)
ViserDex: Visual Sim-to-Real for Robust Dexterous In-hand Reorientation
di: Bhardwaj, Arjun, et al.
Pubblicazione: (2026)
di: Bhardwaj, Arjun, et al.
Pubblicazione: (2026)
Multimodal Spatial Language Maps for Robot Navigation and Manipulation
di: Huang, Chenguang, et al.
Pubblicazione: (2025)
di: Huang, Chenguang, et al.
Pubblicazione: (2025)
NavMapFusion: Diffusion-based Fusion of Navigation Maps for Online Vectorized HD Map Construction
di: Monninger, Thomas, et al.
Pubblicazione: (2025)
di: Monninger, Thomas, et al.
Pubblicazione: (2025)
IPPON: Common Sense Guided Informative Path Planning for Object Goal Navigation
di: Qu, Kaixian, et al.
Pubblicazione: (2024)
di: Qu, Kaixian, et al.
Pubblicazione: (2024)
SE-VLN: A Self-Evolving Vision-Language Navigation Framework Based on Multimodal Large Language Models
di: Dong, Xiangyu, et al.
Pubblicazione: (2025)
di: Dong, Xiangyu, et al.
Pubblicazione: (2025)
SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation
di: Zhang, Jiwen, et al.
Pubblicazione: (2026)
di: Zhang, Jiwen, et al.
Pubblicazione: (2026)
Mapping the Unseen: Unified Promptable Panoptic Mapping with Dynamic Labeling using Foundation Models
di: Mdfaa, Mohamad Al, et al.
Pubblicazione: (2024)
di: Mdfaa, Mohamad Al, et al.
Pubblicazione: (2024)
RoboRefer: Towards Spatial Referring with Reasoning in Vision-Language Models for Robotics
di: Zhou, Enshen, et al.
Pubblicazione: (2025)
di: Zhou, Enshen, et al.
Pubblicazione: (2025)
LetsMap: Unsupervised Representation Learning for Semantic BEV Mapping
di: Gosala, Nikhil, et al.
Pubblicazione: (2024)
di: Gosala, Nikhil, et al.
Pubblicazione: (2024)
ContraMap: Contrastive Uncertainty Mapping for Robot Environment Representation
di: Le, Chi Cuong, et al.
Pubblicazione: (2026)
di: Le, Chi Cuong, et al.
Pubblicazione: (2026)
NavGPT-2: Unleashing Navigational Reasoning Capability for Large Vision-Language Models
di: Zhou, Gengze, et al.
Pubblicazione: (2024)
di: Zhou, Gengze, et al.
Pubblicazione: (2024)
SORT3D: Spatial Object-centric Reasoning Toolbox for Zero-Shot 3D Grounding Using Large Language Models
di: Zantout, Nader, et al.
Pubblicazione: (2025)
di: Zantout, Nader, et al.
Pubblicazione: (2025)
Embodied Spatial Intelligence: from Implicit Scene Modeling to Spatial Reasoning
di: Fang, Jiading
Pubblicazione: (2025)
di: Fang, Jiading
Pubblicazione: (2025)
GlobalMapNet: An Online Framework for Vectorized Global HD Map Construction
di: Shi, Anqi, et al.
Pubblicazione: (2024)
di: Shi, Anqi, et al.
Pubblicazione: (2024)
TopV-Nav: Unlocking the Top-View Spatial Reasoning Potential of MLLM for Zero-shot Object Navigation
di: Zhong, Linqing, et al.
Pubblicazione: (2024)
di: Zhong, Linqing, et al.
Pubblicazione: (2024)
LIAM: Multimodal Transformer for Language Instructions, Images, Actions and Semantic Maps
di: Wang, Yihao, et al.
Pubblicazione: (2025)
di: Wang, Yihao, et al.
Pubblicazione: (2025)
ICGNet: A Unified Approach for Instance-Centric Grasping
di: Zurbrügg, René, et al.
Pubblicazione: (2024)
di: Zurbrügg, René, et al.
Pubblicazione: (2024)
TartanGround: A Large-Scale Dataset for Ground Robot Perception and Navigation
di: Patel, Manthan, et al.
Pubblicazione: (2025)
di: Patel, Manthan, et al.
Pubblicazione: (2025)
Spatial Policy: Guiding Visuomotor Robotic Manipulation with Spatial-Aware Modeling and Reasoning
di: Liu, Yijun, et al.
Pubblicazione: (2025)
di: Liu, Yijun, et al.
Pubblicazione: (2025)
Mapping High-level Semantic Regions in Indoor Environments without Object Recognition
di: Bigazzi, Roberto, et al.
Pubblicazione: (2024)
di: Bigazzi, Roberto, et al.
Pubblicazione: (2024)
Language-Conditioned World Modeling for Visual Navigation
di: Dong, Yifei, et al.
Pubblicazione: (2026)
di: Dong, Yifei, et al.
Pubblicazione: (2026)
Bridging the 2D-3D Gap: A Hierarchical Semantic-Geometric Map for Vision Language Navigation
di: Li, Kailing, et al.
Pubblicazione: (2026)
di: Li, Kailing, et al.
Pubblicazione: (2026)
Deep Radar Inverse Sensor Models for Dynamic Occupancy Grid Maps
di: Wei, Zihang, et al.
Pubblicazione: (2023)
di: Wei, Zihang, et al.
Pubblicazione: (2023)
SoFar: Language-Grounded Orientation Bridges Spatial Reasoning and Object Manipulation
di: Qi, Zekun, et al.
Pubblicazione: (2025)
di: Qi, Zekun, et al.
Pubblicazione: (2025)
LatentPilot: Scene-Aware Vision-and-Language Navigation by Dreaming Ahead with Latent Visual Reasoning
di: Hao, Haihong, et al.
Pubblicazione: (2026)
di: Hao, Haihong, et al.
Pubblicazione: (2026)
A Navigation Framework Utilizing Vision-Language Models
di: Duan, Yicheng, et al.
Pubblicazione: (2025)
di: Duan, Yicheng, et al.
Pubblicazione: (2025)
Efficient Driving Behavior Narration and Reasoning on Edge Device Using Large Language Models
di: Huang, Yizhou, et al.
Pubblicazione: (2024)
di: Huang, Yizhou, et al.
Pubblicazione: (2024)
MindJourney: Test-Time Scaling with World Models for Spatial Reasoning
di: Yang, Yuncong, et al.
Pubblicazione: (2025)
di: Yang, Yuncong, et al.
Pubblicazione: (2025)
Leveraging Large Language Model-based Room-Object Relationships Knowledge for Enhancing Multimodal-Input Object Goal Navigation
di: Sun, Leyuan, et al.
Pubblicazione: (2024)
di: Sun, Leyuan, et al.
Pubblicazione: (2024)
Autonomous Robot for Disaster Mapping and Victim Localization
di: Potter, Michael, et al.
Pubblicazione: (2024)
di: Potter, Michael, et al.
Pubblicazione: (2024)
AugMapNet: Improving Spatial Latent Structure via BEV Grid Augmentation for Enhanced Vectorized Online HD Map Construction
di: Monninger, Thomas, et al.
Pubblicazione: (2025)
di: Monninger, Thomas, et al.
Pubblicazione: (2025)
A Multi-Modal Neuro-Symbolic Approach for Spatial Reasoning-Based Visual Grounding in Robotics
di: Jahangard, Simindokht, et al.
Pubblicazione: (2025)
di: Jahangard, Simindokht, et al.
Pubblicazione: (2025)
NavCoT: Boosting LLM-Based Vision-and-Language Navigation via Learning Disentangled Reasoning
di: Lin, Bingqian, et al.
Pubblicazione: (2024)
di: Lin, Bingqian, et al.
Pubblicazione: (2024)
Robust Vehicle Localization and Tracking in Rain using Street Maps
di: Tan, Yu Xiang, et al.
Pubblicazione: (2024)
di: Tan, Yu Xiang, et al.
Pubblicazione: (2024)
Navigating Motion Agents in Dynamic and Cluttered Environments through LLM Reasoning
di: Zhao, Yubo, et al.
Pubblicazione: (2025)
di: Zhao, Yubo, et al.
Pubblicazione: (2025)
WorldMAP: Bootstrapping Vision-Language Navigation Trajectory Prediction with Generative World Models
di: Chen, Hongjin, et al.
Pubblicazione: (2026)
di: Chen, Hongjin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
MapDream: Task-Driven Map Learning for Vision-Language Navigation
di: Lian, Guoxin, et al.
Pubblicazione: (2026) -
MapGPT: Map-Guided Prompting with Adaptive Path Planning for Vision-and-Language Navigation
di: Chen, Jiaqi, et al.
Pubblicazione: (2024) -
Object Navigation with Structure-Semantic Reasoning-Based Multi-level Map and Multimodal Decision-Making LLM
di: Yan, Chongshang, et al.
Pubblicazione: (2025) -
DiskChunGS: Large-Scale 3D Gaussian SLAM Through Chunk-Based Memory Management
di: Feldmann, Casimir, et al.
Pubblicazione: (2025) -
ViserDex: Visual Sim-to-Real for Robust Dexterous In-hand Reorientation
di: Bhardwaj, Arjun, et al.
Pubblicazione: (2026)