Planning from Imagination: Episodic Simulation and Episodic Memory for Vision-and-Language Navigation
Fuente:
arXiv
Salvato in:
| Autori principali: | Pan, Yiyuan, Xu, Yunzhe, Liu, Zhe, Wang, Hesheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Dream to Recall: Imagination-Guided Experience Retrieval for Memory-Persistent Vision-and-Language Navigation
di: Xu, Yunzhe, et al.
Pubblicazione: (2025)
di: Xu, Yunzhe, et al.
Pubblicazione: (2025)
FLAME: Learning to Navigate with Multimodal LLM in Urban Environments
di: Xu, Yunzhe, et al.
Pubblicazione: (2024)
di: Xu, Yunzhe, et al.
Pubblicazione: (2024)
Imagine, Verify, Execute: Memory-guided Agentic Exploration with Vision-Language Models
di: Lee, Seungjae, et al.
Pubblicazione: (2025)
di: Lee, Seungjae, et al.
Pubblicazione: (2025)
ESceme: Vision-and-Language Navigation with Episodic Scene Memory
di: Zheng, Qi, et al.
Pubblicazione: (2023)
di: Zheng, Qi, et al.
Pubblicazione: (2023)
Visual Episodic Memory-based Exploration
di: Vice, Jack, et al.
Pubblicazione: (2024)
di: Vice, Jack, et al.
Pubblicazione: (2024)
View Invariant Learning for Vision-Language Navigation in Continuous Environments
di: Sun, Josh Qixuan, et al.
Pubblicazione: (2025)
di: Sun, Josh Qixuan, et al.
Pubblicazione: (2025)
Chameleon: Episodic Memory for Long-Horizon Robotic Manipulation
di: Guo, Xinying, et al.
Pubblicazione: (2026)
di: Guo, Xinying, et al.
Pubblicazione: (2026)
Recursive Visual Imagination and Adaptive Linguistic Grounding for Vision Language Navigation
di: Chen, Bolei, et al.
Pubblicazione: (2025)
di: Chen, Bolei, et al.
Pubblicazione: (2025)
ESCAPE: Episodic Spatial Memory and Adaptive Execution Policy for Long-Horizon Mobile Manipulation
di: Qian, Jingjing, et al.
Pubblicazione: (2026)
di: Qian, Jingjing, et al.
Pubblicazione: (2026)
VISTAv2: World Imagination for Indoor Vision-and-Language Navigation
di: Huang, Yanjia, et al.
Pubblicazione: (2025)
di: Huang, Yanjia, et al.
Pubblicazione: (2025)
Vision-Based Deep Reinforcement Learning of UAV Autonomous Navigation Using Privileged Information
di: Wang, Junqiao, et al.
Pubblicazione: (2024)
di: Wang, Junqiao, et al.
Pubblicazione: (2024)
Being-H0: Vision-Language-Action Pretraining from Large-Scale Human Videos
di: Luo, Hao, et al.
Pubblicazione: (2025)
di: Luo, Hao, et al.
Pubblicazione: (2025)
VLA-Cache: Efficient Vision-Language-Action Manipulation via Adaptive Token Caching
di: Xu, Siyu, et al.
Pubblicazione: (2025)
di: Xu, Siyu, et al.
Pubblicazione: (2025)
Automated Data Curation Using GPS & NLP to Generate Instruction-Action Pairs for Autonomous Vehicle Vision-Language Navigation Datasets
di: Roque, Guillermo, et al.
Pubblicazione: (2025)
di: Roque, Guillermo, et al.
Pubblicazione: (2025)
Malicious Path Manipulations via Exploitation of Representation Vulnerabilities of Vision-Language Navigation Systems
di: Islam, Chashi Mahiul, et al.
Pubblicazione: (2024)
di: Islam, Chashi Mahiul, et al.
Pubblicazione: (2024)
SwiftGS: Episodic Priors for Immediate Satellite Surface Recovery
di: Fu, Rong, et al.
Pubblicazione: (2026)
di: Fu, Rong, et al.
Pubblicazione: (2026)
Learning Vision-Based Omnidirectional Navigation: A Teacher-Student Approach Using Monocular Depth Estimation
di: Finke, Jan, et al.
Pubblicazione: (2026)
di: Finke, Jan, et al.
Pubblicazione: (2026)
ChatVLA: Unified Multimodal Understanding and Robot Control with Vision-Language-Action Model
di: Zhou, Zhongyi, et al.
Pubblicazione: (2025)
di: Zhou, Zhongyi, et al.
Pubblicazione: (2025)
Benchmarking Vision, Language, & Action Models on Robotic Learning Tasks
di: Guruprasad, Pranav, et al.
Pubblicazione: (2024)
di: Guruprasad, Pranav, et al.
Pubblicazione: (2024)
Improving Vision-Language-Action Model with Online Reinforcement Learning
di: Guo, Yanjiang, et al.
Pubblicazione: (2025)
di: Guo, Yanjiang, et al.
Pubblicazione: (2025)
Learning in ImaginationLand: Omnidirectional Policies through 3D Generative Models (OP-Gen)
di: Ren, Yifei, et al.
Pubblicazione: (2025)
di: Ren, Yifei, et al.
Pubblicazione: (2025)
ThinkAct: Vision-Language-Action Reasoning via Reinforced Visual Latent Planning
di: Huang, Chi-Pin, et al.
Pubblicazione: (2025)
di: Huang, Chi-Pin, et al.
Pubblicazione: (2025)
VLN-Zero: Rapid Exploration and Cache-Enabled Neurosymbolic Vision-Language Planning for Zero-Shot Transfer in Robot Navigation
di: Bhatt, Neel P., et al.
Pubblicazione: (2025)
di: Bhatt, Neel P., et al.
Pubblicazione: (2025)
Wonder Wins Ways: Curiosity-Driven Exploration through Multi-Agent Contextual Calibration
di: Pan, Yiyuan, et al.
Pubblicazione: (2025)
di: Pan, Yiyuan, et al.
Pubblicazione: (2025)
VisionPAD: A Vision-Centric Pre-training Paradigm for Autonomous Driving
di: Zhang, Haiming, et al.
Pubblicazione: (2024)
di: Zhang, Haiming, et al.
Pubblicazione: (2024)
Towards the Vision-Sound-Language-Action Paradigm: The HEAR Framework for Sound-Centric Manipulation
di: Nie, Chang, et al.
Pubblicazione: (2026)
di: Nie, Chang, et al.
Pubblicazione: (2026)
TRAVEL: Training-Free Retrieval and Alignment for Vision-and-Language Navigation
di: Rajabi, Navid, et al.
Pubblicazione: (2025)
di: Rajabi, Navid, et al.
Pubblicazione: (2025)
FlowHijack: A Dynamics-Aware Backdoor Attack on Flow-Matching Vision-Language-Action Models
di: An, Xinyuan, et al.
Pubblicazione: (2026)
di: An, Xinyuan, et al.
Pubblicazione: (2026)
Tactile Modality Fusion for Vision-Language-Action Models
di: Morissette, Charlotte, et al.
Pubblicazione: (2026)
di: Morissette, Charlotte, et al.
Pubblicazione: (2026)
Fast-ThinkAct: Efficient Vision-Language-Action Reasoning via Verbalizable Latent Planning
di: Huang, Chi-Pin, et al.
Pubblicazione: (2026)
di: Huang, Chi-Pin, et al.
Pubblicazione: (2026)
AutoTrust: Benchmarking Trustworthiness in Large Vision Language Models for Autonomous Driving
di: Xing, Shuo, et al.
Pubblicazione: (2024)
di: Xing, Shuo, et al.
Pubblicazione: (2024)
Universal Pose Pretraining for Generalizable Vision-Language-Action Policies
di: Lin, Haitao, et al.
Pubblicazione: (2026)
di: Lin, Haitao, et al.
Pubblicazione: (2026)
PVI: Plug-in Visual Injection for Vision-Language-Action Models
di: Zhang, Zezhou, et al.
Pubblicazione: (2026)
di: Zhang, Zezhou, et al.
Pubblicazione: (2026)
NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation
di: Zhang, Jiazhao, et al.
Pubblicazione: (2024)
di: Zhang, Jiazhao, et al.
Pubblicazione: (2024)
GenSim: Generating Robotic Simulation Tasks via Large Language Models
di: Wang, Lirui, et al.
Pubblicazione: (2023)
di: Wang, Lirui, et al.
Pubblicazione: (2023)
LiMoE: Mixture of LiDAR Representation Learners from Automotive Scenes
di: Xu, Xiang, et al.
Pubblicazione: (2025)
di: Xu, Xiang, et al.
Pubblicazione: (2025)
Meanings and Measurements: Multi-Agent Probabilistic Grounding for Vision-Language Navigation
di: Padhan, Swagat, et al.
Pubblicazione: (2026)
di: Padhan, Swagat, et al.
Pubblicazione: (2026)
Seeing through Uncertainty: Robust Task-Oriented Optimization in Visual Navigation
di: Pan, Yiyuan, et al.
Pubblicazione: (2025)
di: Pan, Yiyuan, et al.
Pubblicazione: (2025)
Bridging Human Oversight and Black-box Driver Assistance: Vision-Language Models for Predictive Alerting in Lane Keeping Assist Systems
di: Wang, Yuhang, et al.
Pubblicazione: (2025)
di: Wang, Yuhang, et al.
Pubblicazione: (2025)
VLM See, Robot Do: Human Demo Video to Robot Action Plan via Vision Language Model
di: Wang, Beichen, et al.
Pubblicazione: (2024)
di: Wang, Beichen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Dream to Recall: Imagination-Guided Experience Retrieval for Memory-Persistent Vision-and-Language Navigation
di: Xu, Yunzhe, et al.
Pubblicazione: (2025) -
FLAME: Learning to Navigate with Multimodal LLM in Urban Environments
di: Xu, Yunzhe, et al.
Pubblicazione: (2024) -
Imagine, Verify, Execute: Memory-guided Agentic Exploration with Vision-Language Models
di: Lee, Seungjae, et al.
Pubblicazione: (2025) -
ESceme: Vision-and-Language Navigation with Episodic Scene Memory
di: Zheng, Qi, et al.
Pubblicazione: (2023) -
Visual Episodic Memory-based Exploration
di: Vice, Jack, et al.
Pubblicazione: (2024)