Dream to Recall: Imagination-Guided Experience Retrieval for Memory-Persistent Vision-and-Language Navigation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Yunzhe, Pan, Yiyuan, Liu, Zhe |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Planning from Imagination: Episodic Simulation and Episodic Memory for Vision-and-Language Navigation
par: Pan, Yiyuan, et autres
Publié: (2024)
par: Pan, Yiyuan, et autres
Publié: (2024)
FLAME: Learning to Navigate with Multimodal LLM in Urban Environments
par: Xu, Yunzhe, et autres
Publié: (2024)
par: Xu, Yunzhe, et autres
Publié: (2024)
DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation
par: Wang, Yunheng, et autres
Publié: (2025)
par: Wang, Yunheng, et autres
Publié: (2025)
MapDream: Task-Driven Map Learning for Vision-Language Navigation
par: Lian, Guoxin, et autres
Publié: (2026)
par: Lian, Guoxin, et autres
Publié: (2026)
Do Visual Imaginations Improve Vision-and-Language Navigation Agents?
par: Perincherry, Akhil, et autres
Publié: (2025)
par: Perincherry, Akhil, et autres
Publié: (2025)
LatentPilot: Scene-Aware Vision-and-Language Navigation by Dreaming Ahead with Latent Visual Reasoning
par: Hao, Haihong, et autres
Publié: (2026)
par: Hao, Haihong, et autres
Publié: (2026)
Schrödinger's Navigator: Imagining an Ensemble of Futures for Zero-Shot Object Navigation
par: He, Yu, et autres
Publié: (2025)
par: He, Yu, et autres
Publié: (2025)
MapGPT: Map-Guided Prompting with Adaptive Path Planning for Vision-and-Language Navigation
par: Chen, Jiaqi, et autres
Publié: (2024)
par: Chen, Jiaqi, et autres
Publié: (2024)
ActiveVLN: Towards Active Exploration via Multi-Turn RL in Vision-and-Language Navigation
par: Zhang, Zekai, et autres
Publié: (2025)
par: Zhang, Zekai, et autres
Publié: (2025)
What Limits Vision-and-Language Navigation ?
par: Wang, Yunheng, et autres
Publié: (2026)
par: Wang, Yunheng, et autres
Publié: (2026)
A Navigation Framework Utilizing Vision-Language Models
par: Duan, Yicheng, et autres
Publié: (2025)
par: Duan, Yicheng, et autres
Publié: (2025)
AgriVLN: Vision-and-Language Navigation for Agricultural Robots
par: Zhao, Xiaobei, et autres
Publié: (2025)
par: Zhao, Xiaobei, et autres
Publié: (2025)
Vision-Language Navigation with Embodied Intelligence: A Survey
par: Gao, Peng, et autres
Publié: (2024)
par: Gao, Peng, et autres
Publié: (2024)
MonoDream: Monocular Vision-Language Navigation with Panoramic Dreaming
par: Wang, Shuo, et autres
Publié: (2025)
par: Wang, Shuo, et autres
Publié: (2025)
MemoNav: Working Memory Model for Visual Navigation
par: Li, Hongxin, et autres
Publié: (2024)
par: Li, Hongxin, et autres
Publié: (2024)
TRAVEL: Training-Free Retrieval and Alignment for Vision-and-Language Navigation
par: Rajabi, Navid, et autres
Publié: (2025)
par: Rajabi, Navid, et autres
Publié: (2025)
SE-VLN: A Self-Evolving Vision-Language Navigation Framework Based on Multimodal Large Language Models
par: Dong, Xiangyu, et autres
Publié: (2025)
par: Dong, Xiangyu, et autres
Publié: (2025)
AerialVLA: A Vision-Language-Action Model for UAV Navigation via Minimalist End-to-End Control
par: Xu, Peng, et autres
Publié: (2026)
par: Xu, Peng, et autres
Publié: (2026)
Vision-and-Language Navigation Generative Pretrained Transformer
par: Hanlin, Wen
Publié: (2024)
par: Hanlin, Wen
Publié: (2024)
SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation
par: Zhang, Jiwen, et autres
Publié: (2026)
par: Zhang, Jiwen, et autres
Publié: (2026)
WorldMAP: Bootstrapping Vision-Language Navigation Trajectory Prediction with Generative World Models
par: Chen, Hongjin, et autres
Publié: (2026)
par: Chen, Hongjin, et autres
Publié: (2026)
Human-Aware Vision-and-Language Navigation: Bridging Simulation to Reality with Dynamic Human Interactions
par: Li, Heng, et autres
Publié: (2024)
par: Li, Heng, et autres
Publié: (2024)
FloNa: Floor Plan Guided Embodied Visual Navigation
par: Li, Jiaxin, et autres
Publié: (2024)
par: Li, Jiaxin, et autres
Publié: (2024)
DiffVLA: Vision-Language Guided Diffusion Planning for Autonomous Driving
par: Jiang, Anqing, et autres
Publié: (2025)
par: Jiang, Anqing, et autres
Publié: (2025)
Language-Conditioned World Modeling for Visual Navigation
par: Dong, Yifei, et autres
Publié: (2026)
par: Dong, Yifei, et autres
Publié: (2026)
VLA-Pro: Cross-Task Procedural Memory Transfer for Vision-Language-Action Models
par: Si, Shengyu, et autres
Publié: (2026)
par: Si, Shengyu, et autres
Publié: (2026)
Towards Unified World Models for Visual Navigation via Memory-Augmented Planning and Foresight
par: Dong, Yifei, et autres
Publié: (2025)
par: Dong, Yifei, et autres
Publié: (2025)
Ground-level Viewpoint Vision-and-Language Navigation in Continuous Environments
par: Li, Zerui, et autres
Publié: (2025)
par: Li, Zerui, et autres
Publié: (2025)
ALAM: Algebraically Consistent Latent Action Model for Vision-Language-Action Models
par: Tang, Zuojin, et autres
Publié: (2026)
par: Tang, Zuojin, et autres
Publié: (2026)
Towards the Vision-Sound-Language-Action Paradigm: The HEAR Framework for Sound-Centric Manipulation
par: Nie, Chang, et autres
Publié: (2026)
par: Nie, Chang, et autres
Publié: (2026)
NavCoT: Boosting LLM-Based Vision-and-Language Navigation via Learning Disentangled Reasoning
par: Lin, Bingqian, et autres
Publié: (2024)
par: Lin, Bingqian, et autres
Publié: (2024)
Unseen from Seen: Rewriting Observation-Instruction Using Foundation Models for Augmenting Vision-Language Navigation
par: Wei, Ziming, et autres
Publié: (2025)
par: Wei, Ziming, et autres
Publié: (2025)
VISTAv2: World Imagination for Indoor Vision-and-Language Navigation
par: Huang, Yanjia, et autres
Publié: (2025)
par: Huang, Yanjia, et autres
Publié: (2025)
Rethinking the Embodied Gap in Vision-and-Language Navigation: A Holistic Study of Physical and Visual Disparities
par: Wang, Liuyi, et autres
Publié: (2025)
par: Wang, Liuyi, et autres
Publié: (2025)
Exploring the Use of VLMs for Navigation Assistance for People with Blindness and Low Vision
par: Li, Yu, et autres
Publié: (2026)
par: Li, Yu, et autres
Publié: (2026)
Adaptive Diffusion Terrain Generator for Autonomous Uneven Terrain Navigation
par: Yu, Youwei, et autres
Publié: (2024)
par: Yu, Youwei, et autres
Publié: (2024)
SpecPrune-VLA: Accelerating Vision-Language-Action Models via Action-Aware Self-Speculative Pruning
par: Wang, Hanzhen, et autres
Publié: (2025)
par: Wang, Hanzhen, et autres
Publié: (2025)
Sparse Imagination for Efficient Visual World Model Planning
par: Chun, Junha, et autres
Publié: (2025)
par: Chun, Junha, et autres
Publié: (2025)
Self-Correcting VLA: Online Action Refinement via Sparse World Imagination
par: Liu, Chenyv, et autres
Publié: (2026)
par: Liu, Chenyv, et autres
Publié: (2026)
Global Prior Meets Local Consistency: Dual-Memory Augmented Vision-Language-Action Model for Efficient Robotic Manipulation
par: Li, Zaijing, et autres
Publié: (2026)
par: Li, Zaijing, et autres
Publié: (2026)
Documents similaires
-
Planning from Imagination: Episodic Simulation and Episodic Memory for Vision-and-Language Navigation
par: Pan, Yiyuan, et autres
Publié: (2024) -
FLAME: Learning to Navigate with Multimodal LLM in Urban Environments
par: Xu, Yunzhe, et autres
Publié: (2024) -
DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation
par: Wang, Yunheng, et autres
Publié: (2025) -
MapDream: Task-Driven Map Learning for Vision-Language Navigation
par: Lian, Guoxin, et autres
Publié: (2026) -
Do Visual Imaginations Improve Vision-and-Language Navigation Agents?
par: Perincherry, Akhil, et autres
Publié: (2025)