NavOne: One-Step Global Planning for Vision-Language Navigation on Top-Down Maps
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhan, Dijia, Li, Jinyi, Zheng, Chenxi, Huang, Shaoyu, Li, Yong, Tang, Jie, Xu, Xuemiao |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
P$^{3}$Nav: End-to-End Perception, Prediction and Planning for Vision-and-Language Navigation
par: Li, Tianfu, et autres
Publié: (2026)
par: Li, Tianfu, et autres
Publié: (2026)
Xiaomi OneVL: One-Step Latent Reasoning and Planning with Vision-Language Explanation
par: Lu, Jinghui, et autres
Publié: (2026)
par: Lu, Jinghui, et autres
Publié: (2026)
CityNavAgent: Aerial Vision-and-Language Navigation with Hierarchical Semantic Planning and Global Memory
par: Zhang, Weichen, et autres
Publié: (2025)
par: Zhang, Weichen, et autres
Publié: (2025)
Three-Step Nav: A Hierarchical Global-Local Planner for Zero-Shot Vision-and-Language Navigation
par: Zheng, Wanrong, et autres
Publié: (2026)
par: Zheng, Wanrong, et autres
Publié: (2026)
EfficientNav: Towards On-Device Object-Goal Navigation with Navigation Map Caching and Retrieval
par: Yang, Zebin, et autres
Publié: (2025)
par: Yang, Zebin, et autres
Publié: (2025)
VrdONE: One-stage Video Visual Relation Detection
par: Jiang, Xinjie, et autres
Publié: (2024)
par: Jiang, Xinjie, et autres
Publié: (2024)
One Step Learning, One Step Review
par: Huang, Xiaolong, et autres
Publié: (2024)
par: Huang, Xiaolong, et autres
Publié: (2024)
MapNav: A Novel Memory Representation via Annotated Semantic Maps for Vision-and-Language Navigation
par: Zhang, Lingfeng, et autres
Publié: (2025)
par: Zhang, Lingfeng, et autres
Publié: (2025)
SPAN-Nav: Generalized Spatial Awareness for Versatile Vision-Language Navigation
par: Liu, Jiahang, et autres
Publié: (2026)
par: Liu, Jiahang, et autres
Publié: (2026)
CorNav: Autonomous Agent with Self-Corrected Planning for Zero-Shot Vision-and-Language Navigation
par: Liang, Xiwen, et autres
Publié: (2023)
par: Liang, Xiwen, et autres
Publié: (2023)
VL-Nav: A Neuro-Symbolic Approach for Reasoning-based Vision-Language Navigation
par: Du, Yi, et autres
Publié: (2025)
par: Du, Yi, et autres
Publié: (2025)
Nav-SCOPE: Swarm Robot Cooperative Perception and Coordinated Navigation
par: Li, Chenxi, et autres
Publié: (2024)
par: Li, Chenxi, et autres
Publié: (2024)
Seeing 3D Through 2D Lenses: 3D Few-Shot Class-Incremental Learning via Cross-Modal Geometric Rectification
par: Xiang, Tuo, et autres
Publié: (2025)
par: Xiang, Tuo, et autres
Publié: (2025)
SeeNav-Agent: Enhancing Vision-Language Navigation with Visual Prompt and Step-Level Policy Optimization
par: Wang, Zhengcheng, et autres
Publié: (2025)
par: Wang, Zhengcheng, et autres
Publié: (2025)
Mem4Nav: Boosting Vision-and-Language Navigation in Urban Environments with a Hierarchical Spatial-Cognition Long-Short Memory System
par: He, Lixuan, et autres
Publié: (2025)
par: He, Lixuan, et autres
Publié: (2025)
One-shot Transfer Learning for Population Mapping
par: Shao, Erzhuo, et autres
Publié: (2021)
par: Shao, Erzhuo, et autres
Publié: (2021)
One-Step Detection Paradigm for Hyperspectral Anomaly Detection via Spectral Deviation Relationship Learning
par: Li, Jingtao, et autres
Publié: (2023)
par: Li, Jingtao, et autres
Publié: (2023)
NavForesee: A Unified Vision-Language World Model for Hierarchical Planning and Dual-Horizon Navigation Prediction
par: Liu, Fei, et autres
Publié: (2025)
par: Liu, Fei, et autres
Publié: (2025)
NavQ: Learning a Q-Model for Foresighted Vision-and-Language Navigation
par: Xu, Peiran, et autres
Publié: (2025)
par: Xu, Peiran, et autres
Publié: (2025)
ImagineNav: Prompting Vision-Language Models as Embodied Navigator through Scene Imagination
par: Zhao, Xinxin, et autres
Publié: (2024)
par: Zhao, Xinxin, et autres
Publié: (2024)
TopV-Nav: Unlocking the Top-View Spatial Reasoning Potential of MLLM for Zero-shot Object Navigation
par: Zhong, Linqing, et autres
Publié: (2024)
par: Zhong, Linqing, et autres
Publié: (2024)
DeCoNav: Dialog enhanced Long-Horizon Collaborative Vision-Language Navigation
par: Zhou, Sunyao, et autres
Publié: (2026)
par: Zhou, Sunyao, et autres
Publié: (2026)
Geometric Unification of Dark Sectors: A Top-Down Cosmological Framework from the Fantasia Forest
par: Zheng, Xu Jie
Publié: (2025)
par: Zheng, Xu Jie
Publié: (2025)
AdaNav: Adaptive Reasoning with Uncertainty for Vision-Language Navigation
par: Ding, Xin, et autres
Publié: (2025)
par: Ding, Xin, et autres
Publié: (2025)
Truncated Rectified Flow Policy for Reinforcement Learning with One-Step Sampling
par: Zhou, Xubin, et autres
Publié: (2026)
par: Zhou, Xubin, et autres
Publié: (2026)
Mean-Flow based One-Step Vision-Language-Action
par: Chen, Yang, et autres
Publié: (2026)
par: Chen, Yang, et autres
Publié: (2026)
Compression-Aware One-Step Diffusion Model for JPEG Artifact Removal
par: Guo, Jinpei, et autres
Publié: (2025)
par: Guo, Jinpei, et autres
Publié: (2025)
SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation
par: Zhang, Jiwen, et autres
Publié: (2026)
par: Zhang, Jiwen, et autres
Publié: (2026)
Jailbreaking? One Step Is Enough!
par: Zheng, Weixiong, et autres
Publié: (2024)
par: Zheng, Weixiong, et autres
Publié: (2024)
One‐Step Preparation of Lightweight Pulp Composite Foams with Synergistic Flame Retardant and Multiscale Insulation Structures
par: Zhuhan Xu, et autres
Publié: (2025)
par: Zhuhan Xu, et autres
Publié: (2025)
YOPO-Nav: Visual Navigation using 3DGS Graphs from One-Pass Videos
par: Meegan, Ryan, et autres
Publié: (2025)
par: Meegan, Ryan, et autres
Publié: (2025)
MapGPT: Map-Guided Prompting with Adaptive Path Planning for Vision-and-Language Navigation
par: Chen, Jiaqi, et autres
Publié: (2024)
par: Chen, Jiaqi, et autres
Publié: (2024)
One Agent to Guide Them All: Empowering MLLMs for Vision-and-Language Navigation via Explicit World Representation
par: Li, Zerui, et autres
Publié: (2026)
par: Li, Zerui, et autres
Publié: (2026)
NavHint: Vision and Language Navigation Agent with a Hint Generator
par: Zhang, Yue, et autres
Publié: (2024)
par: Zhang, Yue, et autres
Publié: (2024)
PM-Nav: Priori-Map Guided Embodied Navigation in Functional Buildings
par: Gao, Jiang, et autres
Publié: (2026)
par: Gao, Jiang, et autres
Publié: (2026)
NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments
par: Yao, Xuan, et autres
Publié: (2025)
par: Yao, Xuan, et autres
Publié: (2025)
RATE-Nav: Region-Aware Termination Enhancement for Zero-shot Object Navigation with Vision-Language Models
par: Li, Junjie, et autres
Publié: (2025)
par: Li, Junjie, et autres
Publié: (2025)
Nav-R1: Reasoning and Navigation in Embodied Scenes
par: Liu, Qingxiang, et autres
Publié: (2025)
par: Liu, Qingxiang, et autres
Publié: (2025)
NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation
par: Zhang, Jiazhao, et autres
Publié: (2024)
par: Zhang, Jiazhao, et autres
Publié: (2024)
HaltNav: Reactive Visual Halting over Lightweight Topological Priors for Robust Vision-Language Navigation
par: Yu, Zihui, et autres
Publié: (2026)
par: Yu, Zihui, et autres
Publié: (2026)
Documents similaires
-
P$^{3}$Nav: End-to-End Perception, Prediction and Planning for Vision-and-Language Navigation
par: Li, Tianfu, et autres
Publié: (2026) -
Xiaomi OneVL: One-Step Latent Reasoning and Planning with Vision-Language Explanation
par: Lu, Jinghui, et autres
Publié: (2026) -
CityNavAgent: Aerial Vision-and-Language Navigation with Hierarchical Semantic Planning and Global Memory
par: Zhang, Weichen, et autres
Publié: (2025) -
Three-Step Nav: A Hierarchical Global-Local Planner for Zero-Shot Vision-and-Language Navigation
par: Zheng, Wanrong, et autres
Publié: (2026) -
EfficientNav: Towards On-Device Object-Goal Navigation with Navigation Map Caching and Retrieval
par: Yang, Zebin, et autres
Publié: (2025)