NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments
Fuente:
arXiv
Salvato in:
| Autori principali: | Yao, Xuan, Gao, Junyu, Xu, Changsheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fast-Slow Test-Time Adaptation for Online Vision-and-Language Navigation
di: Gao, Junyu, et al.
Pubblicazione: (2023)
di: Gao, Junyu, et al.
Pubblicazione: (2023)
Conjugated Semantic Pool Improves OOD Detection with Pre-trained Vision-Language Models
di: Chen, Mengyuan, et al.
Pubblicazione: (2024)
di: Chen, Mengyuan, et al.
Pubblicazione: (2024)
EvolveNav: Empowering LLM-Based Vision-Language Navigation via Self-Improving Embodied Reasoning
di: Lin, Bingqian, et al.
Pubblicazione: (2025)
di: Lin, Bingqian, et al.
Pubblicazione: (2025)
Open-Nav: Exploring Zero-Shot Vision-and-Language Navigation in Continuous Environment with Open-Source LLMs
di: Qiao, Yanyuan, et al.
Pubblicazione: (2024)
di: Qiao, Yanyuan, et al.
Pubblicazione: (2024)
ETPNav: Evolving Topological Planning for Vision-Language Navigation in Continuous Environments
di: An, Dong, et al.
Pubblicazione: (2023)
di: An, Dong, et al.
Pubblicazione: (2023)
NavForesee: A Unified Vision-Language World Model for Hierarchical Planning and Dual-Horizon Navigation Prediction
di: Liu, Fei, et al.
Pubblicazione: (2025)
di: Liu, Fei, et al.
Pubblicazione: (2025)
LightZeroNav: Zero-Shot Vision Language Navigation in Continuous Environments Based on Lightweight VLMs
di: Luo, Kun, et al.
Pubblicazione: (2026)
di: Luo, Kun, et al.
Pubblicazione: (2026)
NavQ: Learning a Q-Model for Foresighted Vision-and-Language Navigation
di: Xu, Peiran, et al.
Pubblicazione: (2025)
di: Xu, Peiran, et al.
Pubblicazione: (2025)
NavAgent: Multi-scale Urban Street View Fusion For UAV Embodied Vision-and-Language Navigation
di: Liu, Youzhi, et al.
Pubblicazione: (2024)
di: Liu, Youzhi, et al.
Pubblicazione: (2024)
CapNav: Benchmarking Vision Language Models on Capability-conditioned Indoor Navigation
di: Su, Xia, et al.
Pubblicazione: (2026)
di: Su, Xia, et al.
Pubblicazione: (2026)
CorrectNav: Self-Correction Flywheel Empowers Vision-Language-Action Navigation Model
di: Yu, Zhuoyuan, et al.
Pubblicazione: (2025)
di: Yu, Zhuoyuan, et al.
Pubblicazione: (2025)
CorNav: Autonomous Agent with Self-Corrected Planning for Zero-Shot Vision-and-Language Navigation
di: Liang, Xiwen, et al.
Pubblicazione: (2023)
di: Liang, Xiwen, et al.
Pubblicazione: (2023)
Active Zero: Self-Evolving Vision-Language Models through Active Environment Exploration
di: He, Jinghan, et al.
Pubblicazione: (2026)
di: He, Jinghan, et al.
Pubblicazione: (2026)
RATE-Nav: Region-Aware Termination Enhancement for Zero-shot Object Navigation with Vision-Language Models
di: Li, Junjie, et al.
Pubblicazione: (2025)
di: Li, Junjie, et al.
Pubblicazione: (2025)
Constraint-Aware Zero-Shot Vision-Language Navigation in Continuous Environments
di: Chen, Kehan, et al.
Pubblicazione: (2024)
di: Chen, Kehan, et al.
Pubblicazione: (2024)
Language Guided Concept Bottleneck Models for Interpretable Continual Learning
di: Yu, Lu, et al.
Pubblicazione: (2025)
di: Yu, Lu, et al.
Pubblicazione: (2025)
SE-VLN: A Self-Evolving Vision-Language Navigation Framework Based on Multimodal Large Language Models
di: Dong, Xiangyu, et al.
Pubblicazione: (2025)
di: Dong, Xiangyu, et al.
Pubblicazione: (2025)
VL-Nav: A Neuro-Symbolic Approach for Reasoning-based Vision-Language Navigation
di: Du, Yi, et al.
Pubblicazione: (2025)
di: Du, Yi, et al.
Pubblicazione: (2025)
NavBench: Probing Multimodal Large Language Models for Embodied Navigation
di: Qiao, Yanyuan, et al.
Pubblicazione: (2025)
di: Qiao, Yanyuan, et al.
Pubblicazione: (2025)
SEP: Self-Enhanced Prompt Tuning for Visual-Language Model
di: Yao, Hantao, et al.
Pubblicazione: (2024)
di: Yao, Hantao, et al.
Pubblicazione: (2024)
VoroNav: Voronoi-based Zero-shot Object Navigation with Large Language Model
di: Wu, Pengying, et al.
Pubblicazione: (2024)
di: Wu, Pengying, et al.
Pubblicazione: (2024)
EvoVLA: Self-Evolving Vision-Language-Action Model
di: Liu, Zeting, et al.
Pubblicazione: (2025)
di: Liu, Zeting, et al.
Pubblicazione: (2025)
WorldVLN: Autoregressive World Action Model for Aerial Vision-Language Navigation
di: Zhao, Baining, et al.
Pubblicazione: (2026)
di: Zhao, Baining, et al.
Pubblicazione: (2026)
Libra: Building Decoupled Vision System on Large Language Models
di: Xu, Yifan, et al.
Pubblicazione: (2024)
di: Xu, Yifan, et al.
Pubblicazione: (2024)
NavOne: One-Step Global Planning for Vision-Language Navigation on Top-Down Maps
di: Zhan, Dijia, et al.
Pubblicazione: (2026)
di: Zhan, Dijia, et al.
Pubblicazione: (2026)
AstraNav-World: World Model for Foresight Control and Consistency
di: Chen, Jintao, et al.
Pubblicazione: (2025)
di: Chen, Jintao, et al.
Pubblicazione: (2025)
Volumetric Environment Representation for Vision-Language Navigation
di: Liu, Rui, et al.
Pubblicazione: (2024)
di: Liu, Rui, et al.
Pubblicazione: (2024)
SignNav: Leveraging Signage for Semantic Visual Navigation in Large-Scale Indoor Environments
di: Sun, Jian, et al.
Pubblicazione: (2026)
di: Sun, Jian, et al.
Pubblicazione: (2026)
TCP:Textual-based Class-aware Prompt tuning for Visual-Language Model
di: Yao, Hantao, et al.
Pubblicazione: (2023)
di: Yao, Hantao, et al.
Pubblicazione: (2023)
Three-Step Nav: A Hierarchical Global-Local Planner for Zero-Shot Vision-and-Language Navigation
di: Zheng, Wanrong, et al.
Pubblicazione: (2026)
di: Zheng, Wanrong, et al.
Pubblicazione: (2026)
NavGPT-2: Unleashing Navigational Reasoning Capability for Large Vision-Language Models
di: Zhou, Gengze, et al.
Pubblicazione: (2024)
di: Zhou, Gengze, et al.
Pubblicazione: (2024)
SocialNav-MoE: A Mixture-of-Experts Vision Language Model for Socially Compliant Navigation with Reinforcement Fine-Tuning
di: Kawabata, Tomohito, et al.
Pubblicazione: (2025)
di: Kawabata, Tomohito, et al.
Pubblicazione: (2025)
Zero-Shot Vision-and-Language Navigation with Collision Mitigation in Continuous Environment
di: Jeong, Seongjun, et al.
Pubblicazione: (2024)
di: Jeong, Seongjun, et al.
Pubblicazione: (2024)
DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation
di: Wang, Yunheng, et al.
Pubblicazione: (2025)
di: Wang, Yunheng, et al.
Pubblicazione: (2025)
View Invariant Learning for Vision-Language Navigation in Continuous Environments
di: Sun, Josh Qixuan, et al.
Pubblicazione: (2025)
di: Sun, Josh Qixuan, et al.
Pubblicazione: (2025)
HaltNav: Reactive Visual Halting over Lightweight Topological Priors for Robust Vision-Language Navigation
di: Yu, Zihui, et al.
Pubblicazione: (2026)
di: Yu, Zihui, et al.
Pubblicazione: (2026)
VISTAv2: World Imagination for Indoor Vision-and-Language Navigation
di: Huang, Yanjia, et al.
Pubblicazione: (2025)
di: Huang, Yanjia, et al.
Pubblicazione: (2025)
GaussNav: Gaussian Splatting for Visual Navigation
di: Lei, Xiaohan, et al.
Pubblicazione: (2024)
di: Lei, Xiaohan, et al.
Pubblicazione: (2024)
Ground-level Viewpoint Vision-and-Language Navigation in Continuous Environments
di: Li, Zerui, et al.
Pubblicazione: (2025)
di: Li, Zerui, et al.
Pubblicazione: (2025)
Continual Vision-and-Language Navigation
di: Jeong, Seongjun, et al.
Pubblicazione: (2024)
di: Jeong, Seongjun, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Fast-Slow Test-Time Adaptation for Online Vision-and-Language Navigation
di: Gao, Junyu, et al.
Pubblicazione: (2023) -
Conjugated Semantic Pool Improves OOD Detection with Pre-trained Vision-Language Models
di: Chen, Mengyuan, et al.
Pubblicazione: (2024) -
EvolveNav: Empowering LLM-Based Vision-Language Navigation via Self-Improving Embodied Reasoning
di: Lin, Bingqian, et al.
Pubblicazione: (2025) -
Open-Nav: Exploring Zero-Shot Vision-and-Language Navigation in Continuous Environment with Open-Source LLMs
di: Qiao, Yanyuan, et al.
Pubblicazione: (2024) -
ETPNav: Evolving Topological Planning for Vision-Language Navigation in Continuous Environments
di: An, Dong, et al.
Pubblicazione: (2023)