The Essence of Balance for Self-Improving Agents in Vision-and-Language Navigation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Liu, Zhen, Liu, Yuhan, Wang, Jinjun, Liu, Jianyi, Song, Wei, Fu, Jingwen |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Instruction-as-State: Environment-Guided and State-Conditioned Semantic Understanding for Embodied Navigation
von: Liu, Zhen, et al.
Veröffentlicht: (2026)
von: Liu, Zhen, et al.
Veröffentlicht: (2026)
Dual-Anchoring: Addressing State Drift in Vision-Language Navigation
von: Wu, Kangyi, et al.
Veröffentlicht: (2026)
von: Wu, Kangyi, et al.
Veröffentlicht: (2026)
Learning Goal-Oriented Vision-and-Language Navigation with Self-Improving Demonstrations at Scale
von: Li, Songze, et al.
Veröffentlicht: (2025)
von: Li, Songze, et al.
Veröffentlicht: (2025)
Volumetric Environment Representation for Vision-Language Navigation
von: Liu, Rui, et al.
Veröffentlicht: (2024)
von: Liu, Rui, et al.
Veröffentlicht: (2024)
Vision-Language Navigation with Energy-Based Policy
von: Liu, Rui, et al.
Veröffentlicht: (2024)
von: Liu, Rui, et al.
Veröffentlicht: (2024)
Check Field Detection Agent (CFD-Agent) using Multimodal Large Language and Vision Language Models
von: Halder, Sourav, et al.
Veröffentlicht: (2025)
von: Halder, Sourav, et al.
Veröffentlicht: (2025)
NavAgent: Multi-scale Urban Street View Fusion For UAV Embodied Vision-and-Language Navigation
von: Liu, Youzhi, et al.
Veröffentlicht: (2024)
von: Liu, Youzhi, et al.
Veröffentlicht: (2024)
Chain-of-Adaptation: Surgical Vision-Language Adaptation with Reinforcement Learning
von: Li, Jiajie, et al.
Veröffentlicht: (2026)
von: Li, Jiajie, et al.
Veröffentlicht: (2026)
Mind the Gap: Aligning Vision Foundation Models to Image Feature Matching
von: Liu, Yuhan, et al.
Veröffentlicht: (2025)
von: Liu, Yuhan, et al.
Veröffentlicht: (2025)
ESceme: Vision-and-Language Navigation with Episodic Scene Memory
von: Zheng, Qi, et al.
Veröffentlicht: (2023)
von: Zheng, Qi, et al.
Veröffentlicht: (2023)
Weaving Context Across Images: Improving Vision-Language Models through Focus-Centric Visual Chains
von: Zhang, Juntian, et al.
Veröffentlicht: (2025)
von: Zhang, Juntian, et al.
Veröffentlicht: (2025)
Towards Long-Horizon Vision-Language Navigation: Platform, Benchmark and Method
von: Song, Xinshuai, et al.
Veröffentlicht: (2024)
von: Song, Xinshuai, et al.
Veröffentlicht: (2024)
Unleashing the Capabilities of Large Vision-Language Models for Intelligent Perception of Roadside Infrastructure
von: Fu, Luxuan, et al.
Veröffentlicht: (2026)
von: Fu, Luxuan, et al.
Veröffentlicht: (2026)
AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation
von: Guo, Wenxuan, et al.
Veröffentlicht: (2026)
von: Guo, Wenxuan, et al.
Veröffentlicht: (2026)
LookasideVLN: Direction-Aware Aerial Vision-and-Language Navigation
von: Ning, Yuwei, et al.
Veröffentlicht: (2026)
von: Ning, Yuwei, et al.
Veröffentlicht: (2026)
3D Gaussian Map with Open-Set Semantic Grouping for Vision-Language Navigation
von: Gao, Jianzhe, et al.
Veröffentlicht: (2026)
von: Gao, Jianzhe, et al.
Veröffentlicht: (2026)
Navigating Beyond Instructions: Vision-and-Language Navigation in Obstructed Environments
von: Hong, Haodong, et al.
Veröffentlicht: (2024)
von: Hong, Haodong, et al.
Veröffentlicht: (2024)
FlexVLN: Flexible Adaptation for Diverse Vision-and-Language Navigation Tasks
von: Zhang, Siqi, et al.
Veröffentlicht: (2025)
von: Zhang, Siqi, et al.
Veröffentlicht: (2025)
DAP: Domain-aware Prompt Learning for Vision-and-Language Navigation
von: Liu, Ting, et al.
Veröffentlicht: (2023)
von: Liu, Ting, et al.
Veröffentlicht: (2023)
Stop Wandering: Efficient Vision-Language Navigation via Metacognitive Reasoning
von: Li, Xueying, et al.
Veröffentlicht: (2026)
von: Li, Xueying, et al.
Veröffentlicht: (2026)
Agent Journey Beyond RGB: Hierarchical Semantic-Spatial Representation Enrichment for Vision-and-Language Navigation
von: Zhang, Xuesong, et al.
Veröffentlicht: (2024)
von: Zhang, Xuesong, et al.
Veröffentlicht: (2024)
Uncertainty-Aware Gaussian Map for Vision-Language Navigation
von: Gao, Jianzhe, et al.
Veröffentlicht: (2026)
von: Gao, Jianzhe, et al.
Veröffentlicht: (2026)
COSMO: Combination of Selective Memorization for Low-cost Vision-and-Language Navigation
von: Zhang, Siqi, et al.
Veröffentlicht: (2025)
von: Zhang, Siqi, et al.
Veröffentlicht: (2025)
Causality-based Cross-Modal Representation Learning for Vision-and-Language Navigation
von: Wang, Liuyi, et al.
Veröffentlicht: (2024)
von: Wang, Liuyi, et al.
Veröffentlicht: (2024)
Do Visual Imaginations Improve Vision-and-Language Navigation Agents?
von: Perincherry, Akhil, et al.
Veröffentlicht: (2025)
von: Perincherry, Akhil, et al.
Veröffentlicht: (2025)
TagAlign: Improving Vision-Language Alignment with Multi-Tag Classification
von: Liu, Qinying, et al.
Veröffentlicht: (2023)
von: Liu, Qinying, et al.
Veröffentlicht: (2023)
Counterfactual Vision-and-Language Navigation via Adversarial Path Sampling
von: Fu, Tsu-Jui, et al.
Veröffentlicht: (2019)
von: Fu, Tsu-Jui, et al.
Veröffentlicht: (2019)
All-day Multi-scenes Lifelong Vision-and-Language Navigation with Tucker Adaptation
von: Wang, Xudong, et al.
Veröffentlicht: (2026)
von: Wang, Xudong, et al.
Veröffentlicht: (2026)
Stealthy Backdoor Attack in Self-Supervised Learning Vision Encoders for Large Vision Language Models
von: Liu, Zhaoyi, et al.
Veröffentlicht: (2025)
von: Liu, Zhaoyi, et al.
Veröffentlicht: (2025)
REGNav: Room Expert Guided Image-Goal Navigation
von: Li, Pengna, et al.
Veröffentlicht: (2025)
von: Li, Pengna, et al.
Veröffentlicht: (2025)
Trajectory-Diversity-Driven Robust Vision-and-Language Navigation
von: Li, Jiangyang, et al.
Veröffentlicht: (2026)
von: Li, Jiangyang, et al.
Veröffentlicht: (2026)
Vision-and-Language Navigation via Causal Learning
von: Wang, Liuyi, et al.
Veröffentlicht: (2024)
von: Wang, Liuyi, et al.
Veröffentlicht: (2024)
Dynamic Topology Awareness: Breaking the Granularity Rigidity in Vision-Language Navigation
von: Peng, Jiankun, et al.
Veröffentlicht: (2026)
von: Peng, Jiankun, et al.
Veröffentlicht: (2026)
AeroDuo: Aerial Duo for UAV-based Vision and Language Navigation
von: Wu, Ruipu, et al.
Veröffentlicht: (2025)
von: Wu, Ruipu, et al.
Veröffentlicht: (2025)
Vision Also You Need: Navigating Out-of-Distribution Detection with Multimodal Large Language Model
von: Xu, Haoran, et al.
Veröffentlicht: (2026)
von: Xu, Haoran, et al.
Veröffentlicht: (2026)
PatchCue: Enhancing Vision-Language Model Reasoning with Patch-Based Visual Cues
von: Qi, Yukun, et al.
Veröffentlicht: (2026)
von: Qi, Yukun, et al.
Veröffentlicht: (2026)
PASTS: Progress-Aware Spatio-Temporal Transformer Speaker For Vision-and-Language Navigation
von: Wang, Liuyi, et al.
Veröffentlicht: (2023)
von: Wang, Liuyi, et al.
Veröffentlicht: (2023)
General Scene Adaptation for Vision-and-Language Navigation
von: Hong, Haodong, et al.
Veröffentlicht: (2025)
von: Hong, Haodong, et al.
Veröffentlicht: (2025)
MiniVLN: Efficient Vision-and-Language Navigation by Progressive Knowledge Distillation
von: Zhu, Junyou, et al.
Veröffentlicht: (2024)
von: Zhu, Junyou, et al.
Veröffentlicht: (2024)
Fine-Grained Instruction-Guided Graph Reasoning for Vision-and-Language Navigation
von: Liu, Yaohua, et al.
Veröffentlicht: (2025)
von: Liu, Yaohua, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Instruction-as-State: Environment-Guided and State-Conditioned Semantic Understanding for Embodied Navigation
von: Liu, Zhen, et al.
Veröffentlicht: (2026) -
Dual-Anchoring: Addressing State Drift in Vision-Language Navigation
von: Wu, Kangyi, et al.
Veröffentlicht: (2026) -
Learning Goal-Oriented Vision-and-Language Navigation with Self-Improving Demonstrations at Scale
von: Li, Songze, et al.
Veröffentlicht: (2025) -
Volumetric Environment Representation for Vision-Language Navigation
von: Liu, Rui, et al.
Veröffentlicht: (2024) -
Vision-Language Navigation with Energy-Based Policy
von: Liu, Rui, et al.
Veröffentlicht: (2024)