Saved in:
| Main Authors: | Liu, Shengding, Yan, Qiben |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2604.12831 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
IndoorUAV: Benchmarking Vision-Language UAV Navigation in Continuous Indoor Environments
by: Liu, Xu, et al.
Published: (2025)
by: Liu, Xu, et al.
Published: (2025)
Efficient Navigation in Unknown Indoor Environments with Vision-Language Models
by: Schwartz, D., et al.
Published: (2025)
by: Schwartz, D., et al.
Published: (2025)
CapNav: Benchmarking Vision Language Models on Capability-conditioned Indoor Navigation
by: Su, Xia, et al.
Published: (2026)
by: Su, Xia, et al.
Published: (2026)
CoNVOI: Context-aware Navigation using Vision Language Models in Outdoor and Indoor Environments
by: Sathyamoorthy, Adarsh Jagan, et al.
Published: (2024)
by: Sathyamoorthy, Adarsh Jagan, et al.
Published: (2024)
Enhancing Vision-Language Navigation with Multimodal Event Knowledge from Real-World Indoor Tour Videos
by: Xu, Haoxuan, et al.
Published: (2026)
by: Xu, Haoxuan, et al.
Published: (2026)
VISTAv2: World Imagination for Indoor Vision-and-Language Navigation
by: Huang, Yanjia, et al.
Published: (2025)
by: Huang, Yanjia, et al.
Published: (2025)
Co-NavGPT: Multi-Robot Cooperative Visual Semantic Navigation Using Vision Language Models
by: Yu, Bangguo, et al.
Published: (2023)
by: Yu, Bangguo, et al.
Published: (2023)
Safe Multi-Agent Reinforcement Learning for Behavior-Based Cooperative Navigation
by: Dawood, Murad, et al.
Published: (2023)
by: Dawood, Murad, et al.
Published: (2023)
Multi-Robot Cooperative Socially-Aware Navigation Using Multi-Agent Reinforcement Learning
by: Wang, Weizheng, et al.
Published: (2023)
by: Wang, Weizheng, et al.
Published: (2023)
AgentVLN: Towards Agentic Vision-and-Language Navigation
by: Xin, Zihao, et al.
Published: (2026)
by: Xin, Zihao, et al.
Published: (2026)
Online Robot Navigation and Manipulation with Distilled Vision-Language Models
by: Liu, Kangcheng
Published: (2024)
by: Liu, Kangcheng
Published: (2024)
ORION: Option-Regularized Deep Reinforcement Learning for Cooperative Multi-Agent Online Navigation
by: Zhang, Shizhe, et al.
Published: (2026)
by: Zhang, Shizhe, et al.
Published: (2026)
TWC-SLAM: Multi-Agent Cooperative SLAM with Text Semantics and WiFi Features Integration for Similar Indoor Environments
by: Li, Chunyu, et al.
Published: (2025)
by: Li, Chunyu, et al.
Published: (2025)
Cooperative Informative Sensing for Monitoring Dynamic Indoor Environments via Multi-Agent Reinforcement Learning
by: Lee, Kanghoon, et al.
Published: (2026)
by: Lee, Kanghoon, et al.
Published: (2026)
T-araVLN: Translator for Agricultural Robotic Agents on Vision-and-Language Navigation
by: Zhao, Xiaobei, et al.
Published: (2025)
by: Zhao, Xiaobei, et al.
Published: (2025)
Assessing Human Cooperation for Enhancing Social Robot Navigation
by: Arunachalam, Hariharan, et al.
Published: (2025)
by: Arunachalam, Hariharan, et al.
Published: (2025)
CAMON: Cooperative Agents for Multi-Object Navigation with LLM-based Conversations
by: Wu, Pengying, et al.
Published: (2024)
by: Wu, Pengying, et al.
Published: (2024)
Language-Driven Policy Distillation for Cooperative Driving in Multi-Agent Reinforcement Learning
by: Liu, Jiaqi, et al.
Published: (2024)
by: Liu, Jiaqi, et al.
Published: (2024)
Agent-Agnostic Centralized Training for Decentralized Multi-Agent Cooperative Driving
by: Yan, Shengchao, et al.
Published: (2024)
by: Yan, Shengchao, et al.
Published: (2024)
NavAgent: Multi-scale Urban Street View Fusion For UAV Embodied Vision-and-Language Navigation
by: Liu, Youzhi, et al.
Published: (2024)
by: Liu, Youzhi, et al.
Published: (2024)
Learning-Based Navigation for Indoor Mobile Robots
by: Nguyen, Tri-Tin, et al.
Published: (2026)
by: Nguyen, Tri-Tin, et al.
Published: (2026)
Enhancing Lightweight Vision Language Models through Group Competitive Learning for Socially Compliant Navigation
by: Zhang, Xinyu, et al.
Published: (2026)
by: Zhang, Xinyu, et al.
Published: (2026)
AdaNav: Adaptive Reasoning with Uncertainty for Vision-Language Navigation
by: Ding, Xin, et al.
Published: (2025)
by: Ding, Xin, et al.
Published: (2025)
DRAL: Deep Reinforcement Adaptive Learning for Multi-UAVs Navigation in Unknown Indoor Environment
by: Mo, Kangtong, et al.
Published: (2024)
by: Mo, Kangtong, et al.
Published: (2024)
Indoor Localization for Autonomous Robot Navigation
by: Kouma, Sean, et al.
Published: (2025)
by: Kouma, Sean, et al.
Published: (2025)
Endowing Embodied Agents with Spatial Reasoning Capabilities for Vision-and-Language Navigation
by: Bai, Qianqian, et al.
Published: (2025)
by: Bai, Qianqian, et al.
Published: (2025)
MILUV: A Multi-UAV Indoor Localization dataset with UWB and Vision
by: Shalaby, Mohammed Ayman, et al.
Published: (2025)
by: Shalaby, Mohammed Ayman, et al.
Published: (2025)
SEDualVLN: A Spatially-Enhanced Dual-System for Vision-Language Navigation
by: Huang, Jingzhi, et al.
Published: (2026)
by: Huang, Jingzhi, et al.
Published: (2026)
StereoVLA: Enhancing Vision-Language-Action Models with Stereo Vision
by: Deng, Shengliang, et al.
Published: (2025)
by: Deng, Shengliang, et al.
Published: (2025)
InstruGen: Automatic Instruction Generation for Vision-and-Language Navigation Via Large Multimodal Models
by: Yan, Yu, et al.
Published: (2024)
by: Yan, Yu, et al.
Published: (2024)
Hijacking Vision-and-Language Navigation Agents with Adversarial Environmental Attacks
by: Yang, Zijiao, et al.
Published: (2024)
by: Yang, Zijiao, et al.
Published: (2024)
AION: Aerial Indoor Object-Goal Navigation Using Dual-Policy Reinforcement Learning
by: Yan, Zichen, et al.
Published: (2026)
by: Yan, Zichen, et al.
Published: (2026)
Cog-GA: A Large Language Models-based Generative Agent for Vision-Language Navigation in Continuous Environments
by: Li, Zhiyuan, et al.
Published: (2024)
by: Li, Zhiyuan, et al.
Published: (2024)
Fuzzy Logic Control for Indoor Navigation of Mobile Robots
by: Kumar, Akshay, et al.
Published: (2024)
by: Kumar, Akshay, et al.
Published: (2024)
NaviTrace: Evaluating Embodied Navigation of Vision-Language Models
by: Windecker, Tim, et al.
Published: (2025)
by: Windecker, Tim, et al.
Published: (2025)
FloorPlan-VLN: A New Paradigm for Floor Plan Guided Vision-Language Navigation
by: Chen, Kehan, et al.
Published: (2026)
by: Chen, Kehan, et al.
Published: (2026)
Meanings and Measurements: Multi-Agent Probabilistic Grounding for Vision-Language Navigation
by: Padhan, Swagat, et al.
Published: (2026)
by: Padhan, Swagat, et al.
Published: (2026)
Zero-shot Object Navigation with Vision-Language Models Reasoning
by: Wen, Congcong, et al.
Published: (2024)
by: Wen, Congcong, et al.
Published: (2024)
Cooperative Reward Shaping for Multi-Agent Pathfinding
by: Song, Zhenyu, et al.
Published: (2024)
by: Song, Zhenyu, et al.
Published: (2024)
FSR-VLN: Fast and Slow Reasoning for Vision-Language Navigation with Hierarchical Multi-modal Scene Graph
by: Zhou, Xiaolin, et al.
Published: (2025)
by: Zhou, Xiaolin, et al.
Published: (2025)
Similar Items
-
IndoorUAV: Benchmarking Vision-Language UAV Navigation in Continuous Indoor Environments
by: Liu, Xu, et al.
Published: (2025) -
Efficient Navigation in Unknown Indoor Environments with Vision-Language Models
by: Schwartz, D., et al.
Published: (2025) -
CapNav: Benchmarking Vision Language Models on Capability-conditioned Indoor Navigation
by: Su, Xia, et al.
Published: (2026) -
CoNVOI: Context-aware Navigation using Vision Language Models in Outdoor and Indoor Environments
by: Sathyamoorthy, Adarsh Jagan, et al.
Published: (2024) -
Enhancing Vision-Language Navigation with Multimodal Event Knowledge from Real-World Indoor Tour Videos
by: Xu, Haoxuan, et al.
Published: (2026)