CorNav: Autonomous Agent with Self-Corrected Planning for Zero-Shot Vision-and-Language Navigation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liang, Xiwen, Ma, Liang, Guo, Shanshan, Han, Jianhua, Xu, Hang, Ma, Shikui, Liang, Xiaodan |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
NavCoT: Boosting LLM-Based Vision-and-Language Navigation via Learning Disentangled Reasoning
par: Lin, Bingqian, et autres
Publié: (2024)
par: Lin, Bingqian, et autres
Publié: (2024)
Correctable Landmark Discovery via Large Models for Vision-Language Navigation
par: Lin, Bingqian, et autres
Publié: (2024)
par: Lin, Bingqian, et autres
Publié: (2024)
Unseen from Seen: Rewriting Observation-Instruction Using Foundation Models for Augmenting Vision-Language Navigation
par: Wei, Ziming, et autres
Publié: (2025)
par: Wei, Ziming, et autres
Publié: (2025)
EvolveNav: Empowering LLM-Based Vision-Language Navigation via Self-Improving Embodied Reasoning
par: Lin, Bingqian, et autres
Publié: (2025)
par: Lin, Bingqian, et autres
Publié: (2025)
LightZeroNav: Zero-Shot Vision Language Navigation in Continuous Environments Based on Lightweight VLMs
par: Luo, Kun, et autres
Publié: (2026)
par: Luo, Kun, et autres
Publié: (2026)
Structured Preference Optimization for Vision-Language Long-Horizon Task Planning
par: Liang, Xiwen, et autres
Publié: (2025)
par: Liang, Xiwen, et autres
Publié: (2025)
ActionSink: Toward Precise Robot Manipulation with Dynamic Integration of Action Flow
par: Guo, Shanshan, et autres
Publié: (2025)
par: Guo, Shanshan, et autres
Publié: (2025)
Affordances-Oriented Planning using Foundation Models for Continuous Vision-Language Navigation
par: Chen, Jiaqi, et autres
Publié: (2024)
par: Chen, Jiaqi, et autres
Publié: (2024)
DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation
par: Wang, Yunheng, et autres
Publié: (2025)
par: Wang, Yunheng, et autres
Publié: (2025)
CorrectNav: Self-Correction Flywheel Empowers Vision-Language-Action Navigation Model
par: Yu, Zhuoyuan, et autres
Publié: (2025)
par: Yu, Zhuoyuan, et autres
Publié: (2025)
NavHint: Vision and Language Navigation Agent with a Hint Generator
par: Zhang, Yue, et autres
Publié: (2024)
par: Zhang, Yue, et autres
Publié: (2024)
Implicit Geometry Representations for Vision-and-Language Navigation from Web Videos
par: Han, Mingfei, et autres
Publié: (2026)
par: Han, Mingfei, et autres
Publié: (2026)
Constraint-Aware Zero-Shot Vision-Language Navigation in Continuous Environments
par: Chen, Kehan, et autres
Publié: (2024)
par: Chen, Kehan, et autres
Publié: (2024)
SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation
par: Zhang, Jiwen, et autres
Publié: (2026)
par: Zhang, Jiwen, et autres
Publié: (2026)
Actional Atomic-Concept Learning for Demystifying Vision-Language Navigation
par: Lin, Bingqian, et autres
Publié: (2023)
par: Lin, Bingqian, et autres
Publié: (2023)
PIVOT-R: Primitive-Driven Waypoint-Aware World Model for Robotic Manipulation
par: Zhang, Kaidong, et autres
Publié: (2024)
par: Zhang, Kaidong, et autres
Publié: (2024)
Open-Nav: Exploring Zero-Shot Vision-and-Language Navigation in Continuous Environment with Open-Source LLMs
par: Qiao, Yanyuan, et autres
Publié: (2024)
par: Qiao, Yanyuan, et autres
Publié: (2024)
Three-Step Nav: A Hierarchical Global-Local Planner for Zero-Shot Vision-and-Language Navigation
par: Zheng, Wanrong, et autres
Publié: (2026)
par: Zheng, Wanrong, et autres
Publié: (2026)
MapGPT: Map-Guided Prompting with Adaptive Path Planning for Vision-and-Language Navigation
par: Chen, Jiaqi, et autres
Publié: (2024)
par: Chen, Jiaqi, et autres
Publié: (2024)
ConsistNav: Closing the Action Consistency Gap in Zero-Shot Object Navigation with Semantic Executive Control
par: Wang, Haosen, et autres
Publié: (2026)
par: Wang, Haosen, et autres
Publié: (2026)
Spatial-VLN: Zero-Shot Vision-and-Language Navigation With Explicit Spatial Perception and Exploration
par: Yue, Lu, et autres
Publié: (2026)
par: Yue, Lu, et autres
Publié: (2026)
NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments
par: Yao, Xuan, et autres
Publié: (2025)
par: Yao, Xuan, et autres
Publié: (2025)
VoroNav: Voronoi-based Zero-shot Object Navigation with Large Language Model
par: Wu, Pengying, et autres
Publié: (2024)
par: Wu, Pengying, et autres
Publié: (2024)
Holistic Autonomous Driving Understanding by Bird's-Eye-View Injected Multi-Modal Large Models
par: Ding, Xinpeng, et autres
Publié: (2024)
par: Ding, Xinpeng, et autres
Publié: (2024)
CapNav: Benchmarking Vision Language Models on Capability-conditioned Indoor Navigation
par: Su, Xia, et autres
Publié: (2026)
par: Su, Xia, et autres
Publié: (2026)
HiRes-LLaVA: Restoring Fragmentation Input in High-Resolution Large Vision-Language Models
par: Huang, Runhui, et autres
Publié: (2024)
par: Huang, Runhui, et autres
Publié: (2024)
NavOne: One-Step Global Planning for Vision-Language Navigation on Top-Down Maps
par: Zhan, Dijia, et autres
Publié: (2026)
par: Zhan, Dijia, et autres
Publié: (2026)
ETPNav: Evolving Topological Planning for Vision-Language Navigation in Continuous Environments
par: An, Dong, et autres
Publié: (2023)
par: An, Dong, et autres
Publié: (2023)
Language-Driven Visual Consensus for Zero-Shot Semantic Segmentation
par: Zhang, Zicheng, et autres
Publié: (2024)
par: Zhang, Zicheng, et autres
Publié: (2024)
PhyBlock: A Progressive Benchmark for Physical Understanding and Planning via 3D Block Assembly
par: Ma, Liang, et autres
Publié: (2025)
par: Ma, Liang, et autres
Publié: (2025)
AERR-Nav: Adaptive Exploration-Recovery-Reminiscing Strategy for Zero-Shot Object Navigation
par: Huang, Jingzhi, et autres
Publié: (2026)
par: Huang, Jingzhi, et autres
Publié: (2026)
RATE-Nav: Region-Aware Termination Enhancement for Zero-shot Object Navigation with Vision-Language Models
par: Li, Junjie, et autres
Publié: (2025)
par: Li, Junjie, et autres
Publié: (2025)
NavAgent: Multi-scale Urban Street View Fusion For UAV Embodied Vision-and-Language Navigation
par: Liu, Youzhi, et autres
Publié: (2024)
par: Liu, Youzhi, et autres
Publié: (2024)
Zero-Shot 3D Visual Grounding from Vision-Language Models
par: Li, Rong, et autres
Publié: (2025)
par: Li, Rong, et autres
Publié: (2025)
MagicSeg: Open-World Segmentation Pretraining via Counterfactural Diffusion-Based Auto-Generation
par: Cai, Kaixin, et autres
Publié: (2026)
par: Cai, Kaixin, et autres
Publié: (2026)
HumanRefiner: Benchmarking Abnormal Human Generation and Refining with Coarse-to-fine Pose-Reversible Guidance
par: Fang, Guian, et autres
Publié: (2024)
par: Fang, Guian, et autres
Publié: (2024)
EasyControl: Transfer ControlNet to Video Diffusion for Controllable Generation and Interpolation
par: Wang, Cong, et autres
Publié: (2024)
par: Wang, Cong, et autres
Publié: (2024)
NavForesee: A Unified Vision-Language World Model for Hierarchical Planning and Dual-Horizon Navigation Prediction
par: Liu, Fei, et autres
Publié: (2025)
par: Liu, Fei, et autres
Publié: (2025)
NavQ: Learning a Q-Model for Foresighted Vision-and-Language Navigation
par: Xu, Peiran, et autres
Publié: (2025)
par: Xu, Peiran, et autres
Publié: (2025)
Making Pre-trained Language Models Better Continual Few-Shot Relation Extractors
par: Ma, Shengkun, et autres
Publié: (2024)
par: Ma, Shengkun, et autres
Publié: (2024)
Documents similaires
-
NavCoT: Boosting LLM-Based Vision-and-Language Navigation via Learning Disentangled Reasoning
par: Lin, Bingqian, et autres
Publié: (2024) -
Correctable Landmark Discovery via Large Models for Vision-Language Navigation
par: Lin, Bingqian, et autres
Publié: (2024) -
Unseen from Seen: Rewriting Observation-Instruction Using Foundation Models for Augmenting Vision-Language Navigation
par: Wei, Ziming, et autres
Publié: (2025) -
EvolveNav: Empowering LLM-Based Vision-Language Navigation via Self-Improving Embodied Reasoning
par: Lin, Bingqian, et autres
Publié: (2025) -
LightZeroNav: Zero-Shot Vision Language Navigation in Continuous Environments Based on Lightweight VLMs
par: Luo, Kun, et autres
Publié: (2026)