NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yao, Xuan, Gao, Junyu, Xu, Changsheng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Fast-Slow Test-Time Adaptation for Online Vision-and-Language Navigation
par: Gao, Junyu, et autres
Publié: (2023)
par: Gao, Junyu, et autres
Publié: (2023)
Conjugated Semantic Pool Improves OOD Detection with Pre-trained Vision-Language Models
par: Chen, Mengyuan, et autres
Publié: (2024)
par: Chen, Mengyuan, et autres
Publié: (2024)
EvolveNav: Empowering LLM-Based Vision-Language Navigation via Self-Improving Embodied Reasoning
par: Lin, Bingqian, et autres
Publié: (2025)
par: Lin, Bingqian, et autres
Publié: (2025)
Open-Nav: Exploring Zero-Shot Vision-and-Language Navigation in Continuous Environment with Open-Source LLMs
par: Qiao, Yanyuan, et autres
Publié: (2024)
par: Qiao, Yanyuan, et autres
Publié: (2024)
ETPNav: Evolving Topological Planning for Vision-Language Navigation in Continuous Environments
par: An, Dong, et autres
Publié: (2023)
par: An, Dong, et autres
Publié: (2023)
NavForesee: A Unified Vision-Language World Model for Hierarchical Planning and Dual-Horizon Navigation Prediction
par: Liu, Fei, et autres
Publié: (2025)
par: Liu, Fei, et autres
Publié: (2025)
LightZeroNav: Zero-Shot Vision Language Navigation in Continuous Environments Based on Lightweight VLMs
par: Luo, Kun, et autres
Publié: (2026)
par: Luo, Kun, et autres
Publié: (2026)
NavQ: Learning a Q-Model for Foresighted Vision-and-Language Navigation
par: Xu, Peiran, et autres
Publié: (2025)
par: Xu, Peiran, et autres
Publié: (2025)
NavAgent: Multi-scale Urban Street View Fusion For UAV Embodied Vision-and-Language Navigation
par: Liu, Youzhi, et autres
Publié: (2024)
par: Liu, Youzhi, et autres
Publié: (2024)
CapNav: Benchmarking Vision Language Models on Capability-conditioned Indoor Navigation
par: Su, Xia, et autres
Publié: (2026)
par: Su, Xia, et autres
Publié: (2026)
CorrectNav: Self-Correction Flywheel Empowers Vision-Language-Action Navigation Model
par: Yu, Zhuoyuan, et autres
Publié: (2025)
par: Yu, Zhuoyuan, et autres
Publié: (2025)
CorNav: Autonomous Agent with Self-Corrected Planning for Zero-Shot Vision-and-Language Navigation
par: Liang, Xiwen, et autres
Publié: (2023)
par: Liang, Xiwen, et autres
Publié: (2023)
Active Zero: Self-Evolving Vision-Language Models through Active Environment Exploration
par: He, Jinghan, et autres
Publié: (2026)
par: He, Jinghan, et autres
Publié: (2026)
RATE-Nav: Region-Aware Termination Enhancement for Zero-shot Object Navigation with Vision-Language Models
par: Li, Junjie, et autres
Publié: (2025)
par: Li, Junjie, et autres
Publié: (2025)
Constraint-Aware Zero-Shot Vision-Language Navigation in Continuous Environments
par: Chen, Kehan, et autres
Publié: (2024)
par: Chen, Kehan, et autres
Publié: (2024)
Language Guided Concept Bottleneck Models for Interpretable Continual Learning
par: Yu, Lu, et autres
Publié: (2025)
par: Yu, Lu, et autres
Publié: (2025)
SE-VLN: A Self-Evolving Vision-Language Navigation Framework Based on Multimodal Large Language Models
par: Dong, Xiangyu, et autres
Publié: (2025)
par: Dong, Xiangyu, et autres
Publié: (2025)
VL-Nav: A Neuro-Symbolic Approach for Reasoning-based Vision-Language Navigation
par: Du, Yi, et autres
Publié: (2025)
par: Du, Yi, et autres
Publié: (2025)
NavBench: Probing Multimodal Large Language Models for Embodied Navigation
par: Qiao, Yanyuan, et autres
Publié: (2025)
par: Qiao, Yanyuan, et autres
Publié: (2025)
SEP: Self-Enhanced Prompt Tuning for Visual-Language Model
par: Yao, Hantao, et autres
Publié: (2024)
par: Yao, Hantao, et autres
Publié: (2024)
VoroNav: Voronoi-based Zero-shot Object Navigation with Large Language Model
par: Wu, Pengying, et autres
Publié: (2024)
par: Wu, Pengying, et autres
Publié: (2024)
EvoVLA: Self-Evolving Vision-Language-Action Model
par: Liu, Zeting, et autres
Publié: (2025)
par: Liu, Zeting, et autres
Publié: (2025)
WorldVLN: Autoregressive World Action Model for Aerial Vision-Language Navigation
par: Zhao, Baining, et autres
Publié: (2026)
par: Zhao, Baining, et autres
Publié: (2026)
Libra: Building Decoupled Vision System on Large Language Models
par: Xu, Yifan, et autres
Publié: (2024)
par: Xu, Yifan, et autres
Publié: (2024)
NavOne: One-Step Global Planning for Vision-Language Navigation on Top-Down Maps
par: Zhan, Dijia, et autres
Publié: (2026)
par: Zhan, Dijia, et autres
Publié: (2026)
AstraNav-World: World Model for Foresight Control and Consistency
par: Chen, Jintao, et autres
Publié: (2025)
par: Chen, Jintao, et autres
Publié: (2025)
Volumetric Environment Representation for Vision-Language Navigation
par: Liu, Rui, et autres
Publié: (2024)
par: Liu, Rui, et autres
Publié: (2024)
SignNav: Leveraging Signage for Semantic Visual Navigation in Large-Scale Indoor Environments
par: Sun, Jian, et autres
Publié: (2026)
par: Sun, Jian, et autres
Publié: (2026)
TCP:Textual-based Class-aware Prompt tuning for Visual-Language Model
par: Yao, Hantao, et autres
Publié: (2023)
par: Yao, Hantao, et autres
Publié: (2023)
Three-Step Nav: A Hierarchical Global-Local Planner for Zero-Shot Vision-and-Language Navigation
par: Zheng, Wanrong, et autres
Publié: (2026)
par: Zheng, Wanrong, et autres
Publié: (2026)
NavGPT-2: Unleashing Navigational Reasoning Capability for Large Vision-Language Models
par: Zhou, Gengze, et autres
Publié: (2024)
par: Zhou, Gengze, et autres
Publié: (2024)
SocialNav-MoE: A Mixture-of-Experts Vision Language Model for Socially Compliant Navigation with Reinforcement Fine-Tuning
par: Kawabata, Tomohito, et autres
Publié: (2025)
par: Kawabata, Tomohito, et autres
Publié: (2025)
Zero-Shot Vision-and-Language Navigation with Collision Mitigation in Continuous Environment
par: Jeong, Seongjun, et autres
Publié: (2024)
par: Jeong, Seongjun, et autres
Publié: (2024)
DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation
par: Wang, Yunheng, et autres
Publié: (2025)
par: Wang, Yunheng, et autres
Publié: (2025)
View Invariant Learning for Vision-Language Navigation in Continuous Environments
par: Sun, Josh Qixuan, et autres
Publié: (2025)
par: Sun, Josh Qixuan, et autres
Publié: (2025)
HaltNav: Reactive Visual Halting over Lightweight Topological Priors for Robust Vision-Language Navigation
par: Yu, Zihui, et autres
Publié: (2026)
par: Yu, Zihui, et autres
Publié: (2026)
VISTAv2: World Imagination for Indoor Vision-and-Language Navigation
par: Huang, Yanjia, et autres
Publié: (2025)
par: Huang, Yanjia, et autres
Publié: (2025)
GaussNav: Gaussian Splatting for Visual Navigation
par: Lei, Xiaohan, et autres
Publié: (2024)
par: Lei, Xiaohan, et autres
Publié: (2024)
Ground-level Viewpoint Vision-and-Language Navigation in Continuous Environments
par: Li, Zerui, et autres
Publié: (2025)
par: Li, Zerui, et autres
Publié: (2025)
Continual Vision-and-Language Navigation
par: Jeong, Seongjun, et autres
Publié: (2024)
par: Jeong, Seongjun, et autres
Publié: (2024)
Documents similaires
-
Fast-Slow Test-Time Adaptation for Online Vision-and-Language Navigation
par: Gao, Junyu, et autres
Publié: (2023) -
Conjugated Semantic Pool Improves OOD Detection with Pre-trained Vision-Language Models
par: Chen, Mengyuan, et autres
Publié: (2024) -
EvolveNav: Empowering LLM-Based Vision-Language Navigation via Self-Improving Embodied Reasoning
par: Lin, Bingqian, et autres
Publié: (2025) -
Open-Nav: Exploring Zero-Shot Vision-and-Language Navigation in Continuous Environment with Open-Source LLMs
par: Qiao, Yanyuan, et autres
Publié: (2024) -
ETPNav: Evolving Topological Planning for Vision-Language Navigation in Continuous Environments
par: An, Dong, et autres
Publié: (2023)