MapNav: A Novel Memory Representation via Annotated Semantic Maps for Vision-and-Language Navigation
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Lingfeng, Hao, Xiaoshuai, Xu, Qinwen, Zhang, Qiang, Zhang, Xinyao, Wang, Pengwei, Zhang, Jing, Wang, Zhongyuan, Zhang, Shanghang, Xu, Renjing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
$NavA^3$: Understanding Any Instruction, Navigating Anywhere, Finding Anything
di: Zhang, Lingfeng, et al.
Pubblicazione: (2025)
di: Zhang, Lingfeng, et al.
Pubblicazione: (2025)
SocialNav-Map: Dynamic Mapping with Human Trajectory Prediction for Zero-Shot Social Navigation
di: Zhang, Lingfeng, et al.
Pubblicazione: (2025)
di: Zhang, Lingfeng, et al.
Pubblicazione: (2025)
Multi-Floor Zero-Shot Object Navigation Policy
di: Zhang, Lingfeng, et al.
Pubblicazione: (2024)
di: Zhang, Lingfeng, et al.
Pubblicazione: (2024)
AffordGrasp: In-Context Affordance Reasoning for Open-Vocabulary Task-Oriented Grasping in Clutter
di: Tang, Yingbo, et al.
Pubblicazione: (2025)
di: Tang, Yingbo, et al.
Pubblicazione: (2025)
TopoNav: Topological Graphs as a Key Enabler for Advanced Object Navigation
di: Liu, Peiran, et al.
Pubblicazione: (2025)
di: Liu, Peiran, et al.
Pubblicazione: (2025)
TriHelper: Zero-Shot Object Navigation with Dynamic Assistance
di: Zhang, Lingfeng, et al.
Pubblicazione: (2024)
di: Zhang, Lingfeng, et al.
Pubblicazione: (2024)
PIGEON: VLM-Driven Object Navigation via Points of Interest Selection
di: Peng, Cheng, et al.
Pubblicazione: (2025)
di: Peng, Cheng, et al.
Pubblicazione: (2025)
CityNavAgent: Aerial Vision-and-Language Navigation with Hierarchical Semantic Planning and Global Memory
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
BeliefMapNav: 3D Voxel-Based Belief Map for Zero-Shot Object Navigation
di: Zhou, Zibo, et al.
Pubblicazione: (2025)
di: Zhou, Zibo, et al.
Pubblicazione: (2025)
Query-based Semantic Gaussian Field for Scene Representation in Reinforcement Learning
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
SPAN-Nav: Generalized Spatial Awareness for Versatile Vision-Language Navigation
di: Liu, Jiahang, et al.
Pubblicazione: (2026)
di: Liu, Jiahang, et al.
Pubblicazione: (2026)
SSMG-Nav: Enhancing Lifelong Object Navigation with Semantic Skeleton Memory Graph
di: Niu, Haochen, et al.
Pubblicazione: (2026)
di: Niu, Haochen, et al.
Pubblicazione: (2026)
MemoNav: Working Memory Model for Visual Navigation
di: Li, Hongxin, et al.
Pubblicazione: (2024)
di: Li, Hongxin, et al.
Pubblicazione: (2024)
DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation
di: Wang, Yunheng, et al.
Pubblicazione: (2025)
di: Wang, Yunheng, et al.
Pubblicazione: (2025)
NavMapFusion: Diffusion-based Fusion of Navigation Maps for Online Vectorized HD Map Construction
di: Monninger, Thomas, et al.
Pubblicazione: (2025)
di: Monninger, Thomas, et al.
Pubblicazione: (2025)
Reshaping Action Error Distributions for Reliable Vision-Language-Action Models
di: Bai, Shuanghao, et al.
Pubblicazione: (2026)
di: Bai, Shuanghao, et al.
Pubblicazione: (2026)
EfficientNav: Towards On-Device Object-Goal Navigation with Navigation Map Caching and Retrieval
di: Yang, Zebin, et al.
Pubblicazione: (2025)
di: Yang, Zebin, et al.
Pubblicazione: (2025)
METIS: Multi-Source Egocentric Training for Integrated Dexterous Vision-Language-Action Model
di: Fu, Yankai, et al.
Pubblicazione: (2025)
di: Fu, Yankai, et al.
Pubblicazione: (2025)
Learning to Navigate Socially Through Proactive Risk Perception
di: Xiao, Erjia, et al.
Pubblicazione: (2025)
di: Xiao, Erjia, et al.
Pubblicazione: (2025)
Video-CoT: A Comprehensive Dataset for Spatiotemporal Understanding of Videos Based on Chain-of-Thought
di: Zhang, Shuyi, et al.
Pubblicazione: (2025)
di: Zhang, Shuyi, et al.
Pubblicazione: (2025)
AdaNav: Adaptive Reasoning with Uncertainty for Vision-Language Navigation
di: Ding, Xin, et al.
Pubblicazione: (2025)
di: Ding, Xin, et al.
Pubblicazione: (2025)
Is Your HD Map Constructor Reliable under Sensor Corruptions?
di: Hao, Xiaoshuai, et al.
Pubblicazione: (2024)
di: Hao, Xiaoshuai, et al.
Pubblicazione: (2024)
Latent Reasoning VLA: Latent Thinking and Prediction for Vision-Language-Action Models
di: Bai, Shuanghao, et al.
Pubblicazione: (2026)
di: Bai, Shuanghao, et al.
Pubblicazione: (2026)
MAG-Nav: Language-Driven Object Navigation Leveraging Memory-Reserved Active Grounding
di: Zhang, Weifan, et al.
Pubblicazione: (2025)
di: Zhang, Weifan, et al.
Pubblicazione: (2025)
Prompting Multi-Modal Tokens to Enhance End-to-End Autonomous Driving Imitation Learning with LLMs
di: Duan, Yiqun, et al.
Pubblicazione: (2024)
di: Duan, Yiqun, et al.
Pubblicazione: (2024)
osmAG-Nav: A Hierarchical Semantic Topometric Navigation Stack for Robust Lifelong Indoor Autonomy
di: Zhang, Yongqi, et al.
Pubblicazione: (2026)
di: Zhang, Yongqi, et al.
Pubblicazione: (2026)
TIGeR: Tool-Integrated Geometric Reasoning in Vision-Language Models for Robotics
di: Han, Yi, et al.
Pubblicazione: (2025)
di: Han, Yi, et al.
Pubblicazione: (2025)
i2Nav-Robot: A Large-Scale Indoor-Outdoor Robot Dataset for Multi-Sensor Fusion Navigation and Mapping
di: Tang, Hailiang, et al.
Pubblicazione: (2025)
di: Tang, Hailiang, et al.
Pubblicazione: (2025)
SaPaVe: Towards Active Perception and Manipulation in Vision-Language-Action Models for Robotics
di: Liu, Mengzhen, et al.
Pubblicazione: (2026)
di: Liu, Mengzhen, et al.
Pubblicazione: (2026)
DR. Nav: Semantic-Geometric Representations for Proactive Dead-End Recovery and Navigation
di: Rajagopal, Vignesh, et al.
Pubblicazione: (2025)
di: Rajagopal, Vignesh, et al.
Pubblicazione: (2025)
MapDream: Task-Driven Map Learning for Vision-Language Navigation
di: Lian, Guoxin, et al.
Pubblicazione: (2026)
di: Lian, Guoxin, et al.
Pubblicazione: (2026)
NavGSim: High-Fidelity Gaussian Splatting Simulator for Large-Scale Navigation
di: Liu, Jiahang, et al.
Pubblicazione: (2026)
di: Liu, Jiahang, et al.
Pubblicazione: (2026)
LiPS: Large-Scale Humanoid Robot Reinforcement Learning with Parallel-Series Structures
di: Zhang, Qiang, et al.
Pubblicazione: (2025)
di: Zhang, Qiang, et al.
Pubblicazione: (2025)
RoboRefer: Towards Spatial Referring with Reasoning in Vision-Language Models for Robotics
di: Zhou, Enshen, et al.
Pubblicazione: (2025)
di: Zhou, Enshen, et al.
Pubblicazione: (2025)
Intelligent LiDAR Navigation: Leveraging External Information and Semantic Maps with LLM as Copilot
di: Xie, Fujing, et al.
Pubblicazione: (2024)
di: Xie, Fujing, et al.
Pubblicazione: (2024)
CE-Nav: Flow-Guided Reinforcement Refinement for Cross-Embodiment Local Navigation
di: Yang, Kai, et al.
Pubblicazione: (2025)
di: Yang, Kai, et al.
Pubblicazione: (2025)
OpenNavMap: Structure-Free Topometric Mapping via Large-Scale Collaborative Localization
di: Jiao, Jianhao, et al.
Pubblicazione: (2026)
di: Jiao, Jianhao, et al.
Pubblicazione: (2026)
Action-Sketcher: From Reasoning to Action via Visual Sketches for Long-Horizon Robotic Manipulation
di: Tan, Huajie, et al.
Pubblicazione: (2026)
di: Tan, Huajie, et al.
Pubblicazione: (2026)
VoroNav: Voronoi-based Zero-shot Object Navigation with Large Language Model
di: Wu, Pengying, et al.
Pubblicazione: (2024)
di: Wu, Pengying, et al.
Pubblicazione: (2024)
NavOL: Navigation Policy with Online Imitation Learning
di: Wei, Xiaofei, et al.
Pubblicazione: (2026)
di: Wei, Xiaofei, et al.
Pubblicazione: (2026)
Documenti analoghi
-
$NavA^3$: Understanding Any Instruction, Navigating Anywhere, Finding Anything
di: Zhang, Lingfeng, et al.
Pubblicazione: (2025) -
SocialNav-Map: Dynamic Mapping with Human Trajectory Prediction for Zero-Shot Social Navigation
di: Zhang, Lingfeng, et al.
Pubblicazione: (2025) -
Multi-Floor Zero-Shot Object Navigation Policy
di: Zhang, Lingfeng, et al.
Pubblicazione: (2024) -
AffordGrasp: In-Context Affordance Reasoning for Open-Vocabulary Task-Oriented Grasping in Clutter
di: Tang, Yingbo, et al.
Pubblicazione: (2025) -
TopoNav: Topological Graphs as a Key Enabler for Advanced Object Navigation
di: Liu, Peiran, et al.
Pubblicazione: (2025)