HiMemVLN: Enhancing Reliability of Open-Source Zero-Shot Vision-and-Language Navigation with Hierarchical Memory System
Fuente:
arXiv
Salvato in:
| Autori principali: | Lyu, Kailin, Wu, Kangyi, Li, Pengna, Hu, Xiuyu, Si, Qingyi, Miao, Cui, Yang, Ning, Wang, Zihang, Xiao, Long, Hu, Lianyu, Sun, Jingyuan, Hao, Ce |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Dual-Anchoring: Addressing State Drift in Vision-Language Navigation
di: Wu, Kangyi, et al.
Pubblicazione: (2026)
di: Wu, Kangyi, et al.
Pubblicazione: (2026)
REGNav: Room Expert Guided Image-Goal Navigation
di: Li, Pengna, et al.
Pubblicazione: (2025)
di: Li, Pengna, et al.
Pubblicazione: (2025)
SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation
di: Li, Pengna, et al.
Pubblicazione: (2026)
di: Li, Pengna, et al.
Pubblicazione: (2026)
Think before Go: Hierarchical Reasoning for Image-goal Navigation
di: Li, Pengna, et al.
Pubblicazione: (2026)
di: Li, Pengna, et al.
Pubblicazione: (2026)
BrainMem: Brain-Inspired Evolving Memory for Embodied Agent Task Planning
di: Ma, Xiaoyu, et al.
Pubblicazione: (2026)
di: Ma, Xiaoyu, et al.
Pubblicazione: (2026)
VLN-Game: Vision-Language Equilibrium Search for Zero-Shot Semantic Navigation
di: Yu, Bangguo, et al.
Pubblicazione: (2024)
di: Yu, Bangguo, et al.
Pubblicazione: (2024)
Exploring Bottlenecks in VLM-LLM Navigation: How 3D Scene Understanding Capability Impacts Zero-Shot VLN
di: Xia, Ziyi, et al.
Pubblicazione: (2026)
di: Xia, Ziyi, et al.
Pubblicazione: (2026)
SUM-AgriVLN: Spatial Understanding Memory for Agricultural Vision-and-Language Navigation
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
HiMem: Hierarchical Long-Term Memory for LLM Long-Horizon Agents
di: Zhang, Ningning, et al.
Pubblicazione: (2026)
di: Zhang, Ningning, et al.
Pubblicazione: (2026)
HANDO: Hierarchical Autonomous Navigation and Dexterous Omni-loco-manipulation
di: Sun, Jingyuan, et al.
Pubblicazione: (2025)
di: Sun, Jingyuan, et al.
Pubblicazione: (2025)
ReMemNav: A Rethinking and Memory-Augmented Framework for Zero-Shot Object Navigation
di: Wu, Feng, et al.
Pubblicazione: (2026)
di: Wu, Feng, et al.
Pubblicazione: (2026)
Spatial-VLN: Zero-Shot Vision-and-Language Navigation With Explicit Spatial Perception and Exploration
di: Yue, Lu, et al.
Pubblicazione: (2026)
di: Yue, Lu, et al.
Pubblicazione: (2026)
HiMemFormer: Hierarchical Memory-Aware Transformer for Multi-Agent Action Anticipation
di: Wang, Zirui, et al.
Pubblicazione: (2024)
di: Wang, Zirui, et al.
Pubblicazione: (2024)
LookasideVLN: Direction-Aware Aerial Vision-and-Language Navigation
di: Ning, Yuwei, et al.
Pubblicazione: (2026)
di: Ning, Yuwei, et al.
Pubblicazione: (2026)
AgriVLN: Vision-and-Language Navigation for Agricultural Robots
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
CEM-Net: Cross-Emotion Memory Network for Emotional Talking Face Generation
di: Wu, Kangyi, et al.
Pubblicazione: (2025)
di: Wu, Kangyi, et al.
Pubblicazione: (2025)
VLN-Zero: Rapid Exploration and Cache-Enabled Neurosymbolic Vision-Language Planning for Zero-Shot Transfer in Robot Navigation
di: Bhatt, Neel P., et al.
Pubblicazione: (2025)
di: Bhatt, Neel P., et al.
Pubblicazione: (2025)
Camera-aware Label Refinement for Unsupervised Person Re-identification
di: Li, Pengna, et al.
Pubblicazione: (2024)
di: Li, Pengna, et al.
Pubblicazione: (2024)
JanusVLN: Decoupling Semantics and Spatiality with Dual Implicit Memory for Vision-Language Navigation
di: Zeng, Shuang, et al.
Pubblicazione: (2025)
di: Zeng, Shuang, et al.
Pubblicazione: (2025)
DV-VLN: Dual Verification for Reliable LLM-Based Vision-and-Language Navigation
di: Li, Zijun, et al.
Pubblicazione: (2026)
di: Li, Zijun, et al.
Pubblicazione: (2026)
T-araVLN: Translator for Agricultural Robotic Agents on Vision-and-Language Navigation
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
MDE-AgriVLN: Agricultural Vision-and-Language Navigation with Monocular Depth Estimation
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
CMMR-VLN: Vision-and-Language Navigation via Continual Multimodal Memory Retrieval
di: Li, Haozhou, et al.
Pubblicazione: (2026)
di: Li, Haozhou, et al.
Pubblicazione: (2026)
IMAC-AgriVLN: Can Agricultural Vision-and-Language Navigation Agents be Aware of Instruction Mistakes?
di: Zhao, Xiaobei, et al.
Pubblicazione: (2026)
di: Zhao, Xiaobei, et al.
Pubblicazione: (2026)
Open-Nav: Exploring Zero-Shot Vision-and-Language Navigation in Continuous Environment with Open-Source LLMs
di: Qiao, Yanyuan, et al.
Pubblicazione: (2024)
di: Qiao, Yanyuan, et al.
Pubblicazione: (2024)
FSR-VLN: Fast and Slow Reasoning for Vision-Language Navigation with Hierarchical Multi-modal Scene Graph
di: Zhou, Xiaolin, et al.
Pubblicazione: (2025)
di: Zhou, Xiaolin, et al.
Pubblicazione: (2025)
Alignment Imprint: Zero-Shot AI-Generated Text Detection via Provable Preference Discrepancy
di: Wu, Junxi, et al.
Pubblicazione: (2026)
di: Wu, Junxi, et al.
Pubblicazione: (2026)
FluxMem: Adaptive Hierarchical Memory for Streaming Video Understanding
di: Xie, Yiweng, et al.
Pubblicazione: (2026)
di: Xie, Yiweng, et al.
Pubblicazione: (2026)
AgentVLN: Towards Agentic Vision-and-Language Navigation
di: Xin, Zihao, et al.
Pubblicazione: (2026)
di: Xin, Zihao, et al.
Pubblicazione: (2026)
HiCoTraj:Zero-Shot Demographic Reasoning via Hierarchical Chain-of-Thought Prompting from Trajectory
di: Xie, Junyi, et al.
Pubblicazione: (2025)
di: Xie, Junyi, et al.
Pubblicazione: (2025)
HiKER-SGG: Hierarchical Knowledge Enhanced Robust Scene Graph Generation
di: Zhang, Ce, et al.
Pubblicazione: (2024)
di: Zhang, Ce, et al.
Pubblicazione: (2024)
MemRec: Collaborative Memory-Augmented Agentic Recommender System
di: Chen, Weixin, et al.
Pubblicazione: (2026)
di: Chen, Weixin, et al.
Pubblicazione: (2026)
MemRepair: Hierarchical Memory for Agentic Repository-Level Vulnerability Repair
di: Liu, Simiao, et al.
Pubblicazione: (2026)
di: Liu, Simiao, et al.
Pubblicazione: (2026)
MemForest: An Efficient Agent Memory System with Hierarchical Temporal Indexing
di: Chen, Han, et al.
Pubblicazione: (2026)
di: Chen, Han, et al.
Pubblicazione: (2026)
OpenVLN: Open-world Aerial Vision-Language Navigation
di: Lin, Peican, et al.
Pubblicazione: (2025)
di: Lin, Peican, et al.
Pubblicazione: (2025)
AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation
di: Guo, Wenxuan, et al.
Pubblicazione: (2026)
di: Guo, Wenxuan, et al.
Pubblicazione: (2026)
HiAgent: Hierarchical Working Memory Management for Solving Long-Horizon Agent Tasks with Large Language Model
di: Hu, Mengkang, et al.
Pubblicazione: (2024)
di: Hu, Mengkang, et al.
Pubblicazione: (2024)
Mind the Gap: Aligning Vision Foundation Models to Image Feature Matching
di: Liu, Yuhan, et al.
Pubblicazione: (2025)
di: Liu, Yuhan, et al.
Pubblicazione: (2025)
Semantic-aware Representation Learning for Homography Estimation
di: Liu, Yuhan, et al.
Pubblicazione: (2024)
di: Liu, Yuhan, et al.
Pubblicazione: (2024)
Hi-GMAE: Hierarchical Graph Masked Autoencoders
di: Liu, Chuang, et al.
Pubblicazione: (2024)
di: Liu, Chuang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Dual-Anchoring: Addressing State Drift in Vision-Language Navigation
di: Wu, Kangyi, et al.
Pubblicazione: (2026) -
REGNav: Room Expert Guided Image-Goal Navigation
di: Li, Pengna, et al.
Pubblicazione: (2025) -
SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation
di: Li, Pengna, et al.
Pubblicazione: (2026) -
Think before Go: Hierarchical Reasoning for Image-goal Navigation
di: Li, Pengna, et al.
Pubblicazione: (2026) -
BrainMem: Brain-Inspired Evolving Memory for Embodied Agent Task Planning
di: Ma, Xiaoyu, et al.
Pubblicazione: (2026)