Guardado en:
| Autores principales: | Gu, Shutian, Huang, Chengkai, Wang, Ruoyu, Yao, Lina |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2602.15724 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Vision-and-Language Navigation via Causal Learning
por: Wang, Liuyi, et al.
Publicado: (2024)
por: Wang, Liuyi, et al.
Publicado: (2024)
Continual Vision-and-Language Navigation
por: Jeong, Seongjun, et al.
Publicado: (2024)
por: Jeong, Seongjun, et al.
Publicado: (2024)
Beyond Matching to Tiles: Bridging Unaligned Aerial and Satellite Views for Vision-Only UAV Navigation
por: Liu, Kejia, et al.
Publicado: (2026)
por: Liu, Kejia, et al.
Publicado: (2026)
All-day Multi-scenes Lifelong Vision-and-Language Navigation with Tucker Adaptation
por: Wang, Xudong, et al.
Publicado: (2026)
por: Wang, Xudong, et al.
Publicado: (2026)
Navigating the Nuances: A Fine-grained Evaluation of Vision-Language Navigation
por: Wang, Zehao, et al.
Publicado: (2024)
por: Wang, Zehao, et al.
Publicado: (2024)
GA-VLN: Geometry-Aware BEV Representation for Efficient Vision-Language Navigation
por: Yang, Jiahao, et al.
Publicado: (2026)
por: Yang, Jiahao, et al.
Publicado: (2026)
Actional Atomic-Concept Learning for Demystifying Vision-Language Navigation
por: Lin, Bingqian, et al.
Publicado: (2023)
por: Lin, Bingqian, et al.
Publicado: (2023)
MapDream: Task-Driven Map Learning for Vision-Language Navigation
por: Lian, Guoxin, et al.
Publicado: (2026)
por: Lian, Guoxin, et al.
Publicado: (2026)
General Scene Adaptation for Vision-and-Language Navigation
por: Hong, Haodong, et al.
Publicado: (2025)
por: Hong, Haodong, et al.
Publicado: (2025)
UnitedVLN: Generalizable Gaussian Splatting for Continuous Vision-Language Navigation
por: Dai, Guangzhao, et al.
Publicado: (2024)
por: Dai, Guangzhao, et al.
Publicado: (2024)
What Limits Vision-and-Language Navigation ?
por: Wang, Yunheng, et al.
Publicado: (2026)
por: Wang, Yunheng, et al.
Publicado: (2026)
MAGIC: Meta-Ability Guided Interactive Chain-of-Distillation for Effective-and-Efficient Vision-and-Language Navigation
por: Wang, Liuyi, et al.
Publicado: (2024)
por: Wang, Liuyi, et al.
Publicado: (2024)
Vision-Language Navigation with Embodied Intelligence: A Survey
por: Gao, Peng, et al.
Publicado: (2024)
por: Gao, Peng, et al.
Publicado: (2024)
Dream to Recall: Imagination-Guided Experience Retrieval for Memory-Persistent Vision-and-Language Navigation
por: Xu, Yunzhe, et al.
Publicado: (2025)
por: Xu, Yunzhe, et al.
Publicado: (2025)
Dual-Anchoring: Addressing State Drift in Vision-Language Navigation
por: Wu, Kangyi, et al.
Publicado: (2026)
por: Wu, Kangyi, et al.
Publicado: (2026)
Fine-Tuning Vision-Language Models for Visual Navigation Assistance
por: Li, Xiao, et al.
Publicado: (2025)
por: Li, Xiao, et al.
Publicado: (2025)
Self-Supervised Cross-Modal Learning for Image-to-Point Cloud Registration
por: Wang, Xingmei, et al.
Publicado: (2025)
por: Wang, Xingmei, et al.
Publicado: (2025)
Vision-and-Language Navigation with Analogical Textual Descriptions in LLMs
por: Zhang, Yue, et al.
Publicado: (2025)
por: Zhang, Yue, et al.
Publicado: (2025)
\textsc{NaVIDA}: Vision-Language Navigation with Inverse Dynamics Augmentation
por: Zhu, Weiye, et al.
Publicado: (2026)
por: Zhu, Weiye, et al.
Publicado: (2026)
TRAVEL: Training-Free Retrieval and Alignment for Vision-and-Language Navigation
por: Rajabi, Navid, et al.
Publicado: (2025)
por: Rajabi, Navid, et al.
Publicado: (2025)
Why Only Text: Empowering Vision-and-Language Navigation with Multi-modal Prompts
por: Hong, Haodong, et al.
Publicado: (2024)
por: Hong, Haodong, et al.
Publicado: (2024)
LongFly: Long-Horizon UAV Vision-and-Language Navigation with Spatiotemporal Context Integration
por: Jiang, Wen, et al.
Publicado: (2025)
por: Jiang, Wen, et al.
Publicado: (2025)
To Ask or Not to Ask? Detecting Absence of Information in Vision and Language Navigation
por: Abraham, Savitha Sam, et al.
Publicado: (2024)
por: Abraham, Savitha Sam, et al.
Publicado: (2024)
SpatialFly: Geometry-Guided Representation Alignment for UAV Vision-and-Language Navigation in Urban Environments
por: Jiang, Wen, et al.
Publicado: (2026)
por: Jiang, Wen, et al.
Publicado: (2026)
A Navigation Framework Utilizing Vision-Language Models
por: Duan, Yicheng, et al.
Publicado: (2025)
por: Duan, Yicheng, et al.
Publicado: (2025)
AgriVLN: Vision-and-Language Navigation for Agricultural Robots
por: Zhao, Xiaobei, et al.
Publicado: (2025)
por: Zhao, Xiaobei, et al.
Publicado: (2025)
Vision-and-Language Navigation Generative Pretrained Transformer
por: Hanlin, Wen
Publicado: (2024)
por: Hanlin, Wen
Publicado: (2024)
Zero-Shot Vision-and-Language Navigation with Collision Mitigation in Continuous Environment
por: Jeong, Seongjun, et al.
Publicado: (2024)
por: Jeong, Seongjun, et al.
Publicado: (2024)
Fine-Grained Instruction-Guided Graph Reasoning for Vision-and-Language Navigation
por: Liu, Yaohua, et al.
Publicado: (2025)
por: Liu, Yaohua, et al.
Publicado: (2025)
Schrödinger's Navigator: Imagining an Ensemble of Futures for Zero-Shot Object Navigation
por: He, Yu, et al.
Publicado: (2025)
por: He, Yu, et al.
Publicado: (2025)
NavOne: One-Step Global Planning for Vision-Language Navigation on Top-Down Maps
por: Zhan, Dijia, et al.
Publicado: (2026)
por: Zhan, Dijia, et al.
Publicado: (2026)
Weakly-supervised VLM-guided Partial Contrastive Learning for Visual Language Navigation
por: Wang, Ruoyu, et al.
Publicado: (2025)
por: Wang, Ruoyu, et al.
Publicado: (2025)
P2DNav: Panorama-to-Downview Reasoning for Zero-shot Vision-and-Language Navigation
por: Sheng, Kai, et al.
Publicado: (2026)
por: Sheng, Kai, et al.
Publicado: (2026)
PROSPECT: Unified Streaming Vision-Language Navigation via Semantic--Spatial Fusion and Latent Predictive Representation
por: Fan, Zehua, et al.
Publicado: (2026)
por: Fan, Zehua, et al.
Publicado: (2026)
Towards Learning a Generalist Model for Embodied Navigation
por: Zheng, Duo, et al.
Publicado: (2023)
por: Zheng, Duo, et al.
Publicado: (2023)
AerialVLA: A Vision-Language-Action Model for UAV Navigation via Minimalist End-to-End Control
por: Xu, Peng, et al.
Publicado: (2026)
por: Xu, Peng, et al.
Publicado: (2026)
TINA: Think, Interaction, and Action Framework for Zero-Shot Vision Language Navigation
por: Li, Dingbang, et al.
Publicado: (2024)
por: Li, Dingbang, et al.
Publicado: (2024)
Navigation with VLM framework: Towards Going to Any Language
por: Yin, Zecheng, et al.
Publicado: (2024)
por: Yin, Zecheng, et al.
Publicado: (2024)
VELMA: Verbalization Embodiment of LLM Agents for Vision and Language Navigation in Street View
por: Schumann, Raphael, et al.
Publicado: (2023)
por: Schumann, Raphael, et al.
Publicado: (2023)
Exploring the Use of VLMs for Navigation Assistance for People with Blindness and Low Vision
por: Li, Yu, et al.
Publicado: (2026)
por: Li, Yu, et al.
Publicado: (2026)
Ejemplares similares
-
Vision-and-Language Navigation via Causal Learning
por: Wang, Liuyi, et al.
Publicado: (2024) -
Continual Vision-and-Language Navigation
por: Jeong, Seongjun, et al.
Publicado: (2024) -
Beyond Matching to Tiles: Bridging Unaligned Aerial and Satellite Views for Vision-Only UAV Navigation
por: Liu, Kejia, et al.
Publicado: (2026) -
All-day Multi-scenes Lifelong Vision-and-Language Navigation with Tucker Adaptation
por: Wang, Xudong, et al.
Publicado: (2026) -
Navigating the Nuances: A Fine-grained Evaluation of Vision-Language Navigation
por: Wang, Zehao, et al.
Publicado: (2024)