Dream to Recall: Imagination-Guided Experience Retrieval for Memory-Persistent Vision-and-Language Navigation
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Yunzhe, Pan, Yiyuan, Liu, Zhe |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Planning from Imagination: Episodic Simulation and Episodic Memory for Vision-and-Language Navigation
di: Pan, Yiyuan, et al.
Pubblicazione: (2024)
di: Pan, Yiyuan, et al.
Pubblicazione: (2024)
FLAME: Learning to Navigate with Multimodal LLM in Urban Environments
di: Xu, Yunzhe, et al.
Pubblicazione: (2024)
di: Xu, Yunzhe, et al.
Pubblicazione: (2024)
DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation
di: Wang, Yunheng, et al.
Pubblicazione: (2025)
di: Wang, Yunheng, et al.
Pubblicazione: (2025)
MapDream: Task-Driven Map Learning for Vision-Language Navigation
di: Lian, Guoxin, et al.
Pubblicazione: (2026)
di: Lian, Guoxin, et al.
Pubblicazione: (2026)
Do Visual Imaginations Improve Vision-and-Language Navigation Agents?
di: Perincherry, Akhil, et al.
Pubblicazione: (2025)
di: Perincherry, Akhil, et al.
Pubblicazione: (2025)
LatentPilot: Scene-Aware Vision-and-Language Navigation by Dreaming Ahead with Latent Visual Reasoning
di: Hao, Haihong, et al.
Pubblicazione: (2026)
di: Hao, Haihong, et al.
Pubblicazione: (2026)
Schrödinger's Navigator: Imagining an Ensemble of Futures for Zero-Shot Object Navigation
di: He, Yu, et al.
Pubblicazione: (2025)
di: He, Yu, et al.
Pubblicazione: (2025)
MapGPT: Map-Guided Prompting with Adaptive Path Planning for Vision-and-Language Navigation
di: Chen, Jiaqi, et al.
Pubblicazione: (2024)
di: Chen, Jiaqi, et al.
Pubblicazione: (2024)
ActiveVLN: Towards Active Exploration via Multi-Turn RL in Vision-and-Language Navigation
di: Zhang, Zekai, et al.
Pubblicazione: (2025)
di: Zhang, Zekai, et al.
Pubblicazione: (2025)
What Limits Vision-and-Language Navigation ?
di: Wang, Yunheng, et al.
Pubblicazione: (2026)
di: Wang, Yunheng, et al.
Pubblicazione: (2026)
A Navigation Framework Utilizing Vision-Language Models
di: Duan, Yicheng, et al.
Pubblicazione: (2025)
di: Duan, Yicheng, et al.
Pubblicazione: (2025)
AgriVLN: Vision-and-Language Navigation for Agricultural Robots
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
Vision-Language Navigation with Embodied Intelligence: A Survey
di: Gao, Peng, et al.
Pubblicazione: (2024)
di: Gao, Peng, et al.
Pubblicazione: (2024)
MonoDream: Monocular Vision-Language Navigation with Panoramic Dreaming
di: Wang, Shuo, et al.
Pubblicazione: (2025)
di: Wang, Shuo, et al.
Pubblicazione: (2025)
MemoNav: Working Memory Model for Visual Navigation
di: Li, Hongxin, et al.
Pubblicazione: (2024)
di: Li, Hongxin, et al.
Pubblicazione: (2024)
TRAVEL: Training-Free Retrieval and Alignment for Vision-and-Language Navigation
di: Rajabi, Navid, et al.
Pubblicazione: (2025)
di: Rajabi, Navid, et al.
Pubblicazione: (2025)
SE-VLN: A Self-Evolving Vision-Language Navigation Framework Based on Multimodal Large Language Models
di: Dong, Xiangyu, et al.
Pubblicazione: (2025)
di: Dong, Xiangyu, et al.
Pubblicazione: (2025)
AerialVLA: A Vision-Language-Action Model for UAV Navigation via Minimalist End-to-End Control
di: Xu, Peng, et al.
Pubblicazione: (2026)
di: Xu, Peng, et al.
Pubblicazione: (2026)
Vision-and-Language Navigation Generative Pretrained Transformer
di: Hanlin, Wen
Pubblicazione: (2024)
di: Hanlin, Wen
Pubblicazione: (2024)
SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation
di: Zhang, Jiwen, et al.
Pubblicazione: (2026)
di: Zhang, Jiwen, et al.
Pubblicazione: (2026)
WorldMAP: Bootstrapping Vision-Language Navigation Trajectory Prediction with Generative World Models
di: Chen, Hongjin, et al.
Pubblicazione: (2026)
di: Chen, Hongjin, et al.
Pubblicazione: (2026)
Human-Aware Vision-and-Language Navigation: Bridging Simulation to Reality with Dynamic Human Interactions
di: Li, Heng, et al.
Pubblicazione: (2024)
di: Li, Heng, et al.
Pubblicazione: (2024)
FloNa: Floor Plan Guided Embodied Visual Navigation
di: Li, Jiaxin, et al.
Pubblicazione: (2024)
di: Li, Jiaxin, et al.
Pubblicazione: (2024)
DiffVLA: Vision-Language Guided Diffusion Planning for Autonomous Driving
di: Jiang, Anqing, et al.
Pubblicazione: (2025)
di: Jiang, Anqing, et al.
Pubblicazione: (2025)
Language-Conditioned World Modeling for Visual Navigation
di: Dong, Yifei, et al.
Pubblicazione: (2026)
di: Dong, Yifei, et al.
Pubblicazione: (2026)
VLA-Pro: Cross-Task Procedural Memory Transfer for Vision-Language-Action Models
di: Si, Shengyu, et al.
Pubblicazione: (2026)
di: Si, Shengyu, et al.
Pubblicazione: (2026)
Towards Unified World Models for Visual Navigation via Memory-Augmented Planning and Foresight
di: Dong, Yifei, et al.
Pubblicazione: (2025)
di: Dong, Yifei, et al.
Pubblicazione: (2025)
Ground-level Viewpoint Vision-and-Language Navigation in Continuous Environments
di: Li, Zerui, et al.
Pubblicazione: (2025)
di: Li, Zerui, et al.
Pubblicazione: (2025)
ALAM: Algebraically Consistent Latent Action Model for Vision-Language-Action Models
di: Tang, Zuojin, et al.
Pubblicazione: (2026)
di: Tang, Zuojin, et al.
Pubblicazione: (2026)
Towards the Vision-Sound-Language-Action Paradigm: The HEAR Framework for Sound-Centric Manipulation
di: Nie, Chang, et al.
Pubblicazione: (2026)
di: Nie, Chang, et al.
Pubblicazione: (2026)
NavCoT: Boosting LLM-Based Vision-and-Language Navigation via Learning Disentangled Reasoning
di: Lin, Bingqian, et al.
Pubblicazione: (2024)
di: Lin, Bingqian, et al.
Pubblicazione: (2024)
Unseen from Seen: Rewriting Observation-Instruction Using Foundation Models for Augmenting Vision-Language Navigation
di: Wei, Ziming, et al.
Pubblicazione: (2025)
di: Wei, Ziming, et al.
Pubblicazione: (2025)
VISTAv2: World Imagination for Indoor Vision-and-Language Navigation
di: Huang, Yanjia, et al.
Pubblicazione: (2025)
di: Huang, Yanjia, et al.
Pubblicazione: (2025)
Rethinking the Embodied Gap in Vision-and-Language Navigation: A Holistic Study of Physical and Visual Disparities
di: Wang, Liuyi, et al.
Pubblicazione: (2025)
di: Wang, Liuyi, et al.
Pubblicazione: (2025)
Exploring the Use of VLMs for Navigation Assistance for People with Blindness and Low Vision
di: Li, Yu, et al.
Pubblicazione: (2026)
di: Li, Yu, et al.
Pubblicazione: (2026)
Adaptive Diffusion Terrain Generator for Autonomous Uneven Terrain Navigation
di: Yu, Youwei, et al.
Pubblicazione: (2024)
di: Yu, Youwei, et al.
Pubblicazione: (2024)
SpecPrune-VLA: Accelerating Vision-Language-Action Models via Action-Aware Self-Speculative Pruning
di: Wang, Hanzhen, et al.
Pubblicazione: (2025)
di: Wang, Hanzhen, et al.
Pubblicazione: (2025)
Sparse Imagination for Efficient Visual World Model Planning
di: Chun, Junha, et al.
Pubblicazione: (2025)
di: Chun, Junha, et al.
Pubblicazione: (2025)
Self-Correcting VLA: Online Action Refinement via Sparse World Imagination
di: Liu, Chenyv, et al.
Pubblicazione: (2026)
di: Liu, Chenyv, et al.
Pubblicazione: (2026)
Global Prior Meets Local Consistency: Dual-Memory Augmented Vision-Language-Action Model for Efficient Robotic Manipulation
di: Li, Zaijing, et al.
Pubblicazione: (2026)
di: Li, Zaijing, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Planning from Imagination: Episodic Simulation and Episodic Memory for Vision-and-Language Navigation
di: Pan, Yiyuan, et al.
Pubblicazione: (2024) -
FLAME: Learning to Navigate with Multimodal LLM in Urban Environments
di: Xu, Yunzhe, et al.
Pubblicazione: (2024) -
DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation
di: Wang, Yunheng, et al.
Pubblicazione: (2025) -
MapDream: Task-Driven Map Learning for Vision-Language Navigation
di: Lian, Guoxin, et al.
Pubblicazione: (2026) -
Do Visual Imaginations Improve Vision-and-Language Navigation Agents?
di: Perincherry, Akhil, et al.
Pubblicazione: (2025)