Ground-level Viewpoint Vision-and-Language Navigation in Continuous Environments
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Zerui, Zhou, Gengze, Hong, Haodong, Shao, Yanyan, Lyu, Wenqi, Qiao, Yanyuan, Wu, Qi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Open-Nav: Exploring Zero-Shot Vision-and-Language Navigation in Continuous Environment with Open-Source LLMs
por: Qiao, Yanyuan, et al.
Publicado: (2024)
por: Qiao, Yanyuan, et al.
Publicado: (2024)
SmartWay: Enhanced Waypoint Prediction and Backtracking for Zero-Shot Vision-and-Language Navigation
por: Shi, Xiangyu, et al.
Publicado: (2025)
por: Shi, Xiangyu, et al.
Publicado: (2025)
Navigating Beyond Instructions: Vision-and-Language Navigation in Obstructed Environments
por: Hong, Haodong, et al.
Publicado: (2024)
por: Hong, Haodong, et al.
Publicado: (2024)
Fast-SmartWay: Panoramic-Free End-to-End Zero-Shot Vision-and-Language Navigation
por: Shi, Xiangyu, et al.
Publicado: (2025)
por: Shi, Xiangyu, et al.
Publicado: (2025)
NavGPT-2: Unleashing Navigational Reasoning Capability for Large Vision-Language Models
por: Zhou, Gengze, et al.
Publicado: (2024)
por: Zhou, Gengze, et al.
Publicado: (2024)
BadNAVer: Exploring Jailbreak Attacks On Vision-and-Language Navigation
por: Lyu, Wenqi, et al.
Publicado: (2025)
por: Lyu, Wenqi, et al.
Publicado: (2025)
General Scene Adaptation for Vision-and-Language Navigation
por: Hong, Haodong, et al.
Publicado: (2025)
por: Hong, Haodong, et al.
Publicado: (2025)
SAME: Learning Generic Language-Guided Visual Navigation with State-Adaptive Mixture of Experts
por: Zhou, Gengze, et al.
Publicado: (2024)
por: Zhou, Gengze, et al.
Publicado: (2024)
VLN-MME: Diagnosing MLLMs as Language-guided Visual Navigation agents
por: Zhao, Xunyi, et al.
Publicado: (2025)
por: Zhao, Xunyi, et al.
Publicado: (2025)
ETPNav: Evolving Topological Planning for Vision-Language Navigation in Continuous Environments
por: An, Dong, et al.
Publicado: (2023)
por: An, Dong, et al.
Publicado: (2023)
COSMO: Combination of Selective Memorization for Low-cost Vision-and-Language Navigation
por: Zhang, Siqi, et al.
Publicado: (2025)
por: Zhang, Siqi, et al.
Publicado: (2025)
NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation
por: Zhang, Jiazhao, et al.
Publicado: (2024)
por: Zhang, Jiazhao, et al.
Publicado: (2024)
VLNVerse: A Benchmark for Vision-Language Navigation with Versatile, Embodied, Realistic Simulation and Evaluation
por: Lin, Sihao, et al.
Publicado: (2025)
por: Lin, Sihao, et al.
Publicado: (2025)
NavBench: Probing Multimodal Large Language Models for Embodied Navigation
por: Qiao, Yanyuan, et al.
Publicado: (2025)
por: Qiao, Yanyuan, et al.
Publicado: (2025)
FlexVLN: Flexible Adaptation for Diverse Vision-and-Language Navigation Tasks
por: Zhang, Siqi, et al.
Publicado: (2025)
por: Zhang, Siqi, et al.
Publicado: (2025)
Vision-and-Language Navigation Today and Tomorrow: A Survey in the Era of Foundation Models
por: Zhang, Yue, et al.
Publicado: (2024)
por: Zhang, Yue, et al.
Publicado: (2024)
Meanings and Measurements: Multi-Agent Probabilistic Grounding for Vision-Language Navigation
por: Padhan, Swagat, et al.
Publicado: (2026)
por: Padhan, Swagat, et al.
Publicado: (2026)
What Limits Vision-and-Language Navigation ?
por: Wang, Yunheng, et al.
Publicado: (2026)
por: Wang, Yunheng, et al.
Publicado: (2026)
Recursive Visual Imagination and Adaptive Linguistic Grounding for Vision Language Navigation
por: Chen, Bolei, et al.
Publicado: (2025)
por: Chen, Bolei, et al.
Publicado: (2025)
VLN-NF: Feasibility-Aware Vision-and-Language Navigation with False-Premise Instructions
por: Su, Hung-Ting, et al.
Publicado: (2026)
por: Su, Hung-Ting, et al.
Publicado: (2026)
Vision-and-Language Navigation Generative Pretrained Transformer
por: Hanlin, Wen
Publicado: (2024)
por: Hanlin, Wen
Publicado: (2024)
End-to-End Navigation with Vision Language Models: Transforming Spatial Reasoning into Question-Answering
por: Goetting, Dylan, et al.
Publicado: (2024)
por: Goetting, Dylan, et al.
Publicado: (2024)
Why Only Text: Empowering Vision-and-Language Navigation with Multi-modal Prompts
por: Hong, Haodong, et al.
Publicado: (2024)
por: Hong, Haodong, et al.
Publicado: (2024)
Constraint-Aware Zero-Shot Vision-Language Navigation in Continuous Environments
por: Chen, Kehan, et al.
Publicado: (2024)
por: Chen, Kehan, et al.
Publicado: (2024)
ST-Booster: An Iterative SpatioTemporal Perception Booster for Vision-and-Language Navigation in Continuous Environments
por: Yue, Lu, et al.
Publicado: (2025)
por: Yue, Lu, et al.
Publicado: (2025)
ProGAL-VLA: Grounded Alignment through Prospective Reasoning in Vision-Language-Action Models
por: Darabi, Nastaran, et al.
Publicado: (2026)
por: Darabi, Nastaran, et al.
Publicado: (2026)
DivScene: Towards Open-Vocabulary Object Navigation with Large Vision Language Models in Diverse Scenes
por: Wang, Zhaowei, et al.
Publicado: (2024)
por: Wang, Zhaowei, et al.
Publicado: (2024)
Do Visual Imaginations Improve Vision-and-Language Navigation Agents?
por: Perincherry, Akhil, et al.
Publicado: (2025)
por: Perincherry, Akhil, et al.
Publicado: (2025)
Cross from Left to Right Brain: Adaptive Text Dreamer for Vision-and-Language Navigation
por: Zhang, Pingrui, et al.
Publicado: (2025)
por: Zhang, Pingrui, et al.
Publicado: (2025)
View Invariant Learning for Vision-Language Navigation in Continuous Environments
por: Sun, Josh Qixuan, et al.
Publicado: (2025)
por: Sun, Josh Qixuan, et al.
Publicado: (2025)
Affordances-Oriented Planning using Foundation Models for Continuous Vision-Language Navigation
por: Chen, Jiaqi, et al.
Publicado: (2024)
por: Chen, Jiaqi, et al.
Publicado: (2024)
Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration
por: Wang, Jun, et al.
Publicado: (2026)
por: Wang, Jun, et al.
Publicado: (2026)
Does Peer Observation Help? Vision-Sharing Collaboration for Vision-Language Navigation
por: Jin, Qunchao, et al.
Publicado: (2026)
por: Jin, Qunchao, et al.
Publicado: (2026)
CorrectNav: Self-Correction Flywheel Empowers Vision-Language-Action Navigation Model
por: Yu, Zhuoyuan, et al.
Publicado: (2025)
por: Yu, Zhuoyuan, et al.
Publicado: (2025)
FLAME: Learning to Navigate with Multimodal LLM in Urban Environments
por: Xu, Yunzhe, et al.
Publicado: (2024)
por: Xu, Yunzhe, et al.
Publicado: (2024)
Rethinking the Embodied Gap in Vision-and-Language Navigation: A Holistic Study of Physical and Visual Disparities
por: Wang, Liuyi, et al.
Publicado: (2025)
por: Wang, Liuyi, et al.
Publicado: (2025)
DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation
por: Wang, Yunheng, et al.
Publicado: (2025)
por: Wang, Yunheng, et al.
Publicado: (2025)
NavCoT: Boosting LLM-Based Vision-and-Language Navigation via Learning Disentangled Reasoning
por: Lin, Bingqian, et al.
Publicado: (2024)
por: Lin, Bingqian, et al.
Publicado: (2024)
Let's Reward Step-by-Step: Step-Aware Contrastive Alignment for Vision-Language Navigation in Continuous Environments
por: Li, Haoyuan, et al.
Publicado: (2026)
por: Li, Haoyuan, et al.
Publicado: (2026)
Unseen from Seen: Rewriting Observation-Instruction Using Foundation Models for Augmenting Vision-Language Navigation
por: Wei, Ziming, et al.
Publicado: (2025)
por: Wei, Ziming, et al.
Publicado: (2025)
Ejemplares similares
-
Open-Nav: Exploring Zero-Shot Vision-and-Language Navigation in Continuous Environment with Open-Source LLMs
por: Qiao, Yanyuan, et al.
Publicado: (2024) -
SmartWay: Enhanced Waypoint Prediction and Backtracking for Zero-Shot Vision-and-Language Navigation
por: Shi, Xiangyu, et al.
Publicado: (2025) -
Navigating Beyond Instructions: Vision-and-Language Navigation in Obstructed Environments
por: Hong, Haodong, et al.
Publicado: (2024) -
Fast-SmartWay: Panoramic-Free End-to-End Zero-Shot Vision-and-Language Navigation
por: Shi, Xiangyu, et al.
Publicado: (2025) -
NavGPT-2: Unleashing Navigational Reasoning Capability for Large Vision-Language Models
por: Zhou, Gengze, et al.
Publicado: (2024)