HiMemVLN: Enhancing Reliability of Open-Source Zero-Shot Vision-and-Language Navigation with Hierarchical Memory System
Fuente:
arXiv
Guardado en:
| Autores principales: | Lyu, Kailin, Wu, Kangyi, Li, Pengna, Hu, Xiuyu, Si, Qingyi, Miao, Cui, Yang, Ning, Wang, Zihang, Xiao, Long, Hu, Lianyu, Sun, Jingyuan, Hao, Ce |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Dual-Anchoring: Addressing State Drift in Vision-Language Navigation
por: Wu, Kangyi, et al.
Publicado: (2026)
por: Wu, Kangyi, et al.
Publicado: (2026)
REGNav: Room Expert Guided Image-Goal Navigation
por: Li, Pengna, et al.
Publicado: (2025)
por: Li, Pengna, et al.
Publicado: (2025)
SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation
por: Li, Pengna, et al.
Publicado: (2026)
por: Li, Pengna, et al.
Publicado: (2026)
Think before Go: Hierarchical Reasoning for Image-goal Navigation
por: Li, Pengna, et al.
Publicado: (2026)
por: Li, Pengna, et al.
Publicado: (2026)
BrainMem: Brain-Inspired Evolving Memory for Embodied Agent Task Planning
por: Ma, Xiaoyu, et al.
Publicado: (2026)
por: Ma, Xiaoyu, et al.
Publicado: (2026)
VLN-Game: Vision-Language Equilibrium Search for Zero-Shot Semantic Navigation
por: Yu, Bangguo, et al.
Publicado: (2024)
por: Yu, Bangguo, et al.
Publicado: (2024)
Exploring Bottlenecks in VLM-LLM Navigation: How 3D Scene Understanding Capability Impacts Zero-Shot VLN
por: Xia, Ziyi, et al.
Publicado: (2026)
por: Xia, Ziyi, et al.
Publicado: (2026)
SUM-AgriVLN: Spatial Understanding Memory for Agricultural Vision-and-Language Navigation
por: Zhao, Xiaobei, et al.
Publicado: (2025)
por: Zhao, Xiaobei, et al.
Publicado: (2025)
HiMem: Hierarchical Long-Term Memory for LLM Long-Horizon Agents
por: Zhang, Ningning, et al.
Publicado: (2026)
por: Zhang, Ningning, et al.
Publicado: (2026)
HANDO: Hierarchical Autonomous Navigation and Dexterous Omni-loco-manipulation
por: Sun, Jingyuan, et al.
Publicado: (2025)
por: Sun, Jingyuan, et al.
Publicado: (2025)
ReMemNav: A Rethinking and Memory-Augmented Framework for Zero-Shot Object Navigation
por: Wu, Feng, et al.
Publicado: (2026)
por: Wu, Feng, et al.
Publicado: (2026)
Spatial-VLN: Zero-Shot Vision-and-Language Navigation With Explicit Spatial Perception and Exploration
por: Yue, Lu, et al.
Publicado: (2026)
por: Yue, Lu, et al.
Publicado: (2026)
HiMemFormer: Hierarchical Memory-Aware Transformer for Multi-Agent Action Anticipation
por: Wang, Zirui, et al.
Publicado: (2024)
por: Wang, Zirui, et al.
Publicado: (2024)
LookasideVLN: Direction-Aware Aerial Vision-and-Language Navigation
por: Ning, Yuwei, et al.
Publicado: (2026)
por: Ning, Yuwei, et al.
Publicado: (2026)
AgriVLN: Vision-and-Language Navigation for Agricultural Robots
por: Zhao, Xiaobei, et al.
Publicado: (2025)
por: Zhao, Xiaobei, et al.
Publicado: (2025)
CEM-Net: Cross-Emotion Memory Network for Emotional Talking Face Generation
por: Wu, Kangyi, et al.
Publicado: (2025)
por: Wu, Kangyi, et al.
Publicado: (2025)
VLN-Zero: Rapid Exploration and Cache-Enabled Neurosymbolic Vision-Language Planning for Zero-Shot Transfer in Robot Navigation
por: Bhatt, Neel P., et al.
Publicado: (2025)
por: Bhatt, Neel P., et al.
Publicado: (2025)
Camera-aware Label Refinement for Unsupervised Person Re-identification
por: Li, Pengna, et al.
Publicado: (2024)
por: Li, Pengna, et al.
Publicado: (2024)
JanusVLN: Decoupling Semantics and Spatiality with Dual Implicit Memory for Vision-Language Navigation
por: Zeng, Shuang, et al.
Publicado: (2025)
por: Zeng, Shuang, et al.
Publicado: (2025)
DV-VLN: Dual Verification for Reliable LLM-Based Vision-and-Language Navigation
por: Li, Zijun, et al.
Publicado: (2026)
por: Li, Zijun, et al.
Publicado: (2026)
T-araVLN: Translator for Agricultural Robotic Agents on Vision-and-Language Navigation
por: Zhao, Xiaobei, et al.
Publicado: (2025)
por: Zhao, Xiaobei, et al.
Publicado: (2025)
MDE-AgriVLN: Agricultural Vision-and-Language Navigation with Monocular Depth Estimation
por: Zhao, Xiaobei, et al.
Publicado: (2025)
por: Zhao, Xiaobei, et al.
Publicado: (2025)
CMMR-VLN: Vision-and-Language Navigation via Continual Multimodal Memory Retrieval
por: Li, Haozhou, et al.
Publicado: (2026)
por: Li, Haozhou, et al.
Publicado: (2026)
IMAC-AgriVLN: Can Agricultural Vision-and-Language Navigation Agents be Aware of Instruction Mistakes?
por: Zhao, Xiaobei, et al.
Publicado: (2026)
por: Zhao, Xiaobei, et al.
Publicado: (2026)
Open-Nav: Exploring Zero-Shot Vision-and-Language Navigation in Continuous Environment with Open-Source LLMs
por: Qiao, Yanyuan, et al.
Publicado: (2024)
por: Qiao, Yanyuan, et al.
Publicado: (2024)
FSR-VLN: Fast and Slow Reasoning for Vision-Language Navigation with Hierarchical Multi-modal Scene Graph
por: Zhou, Xiaolin, et al.
Publicado: (2025)
por: Zhou, Xiaolin, et al.
Publicado: (2025)
Alignment Imprint: Zero-Shot AI-Generated Text Detection via Provable Preference Discrepancy
por: Wu, Junxi, et al.
Publicado: (2026)
por: Wu, Junxi, et al.
Publicado: (2026)
FluxMem: Adaptive Hierarchical Memory for Streaming Video Understanding
por: Xie, Yiweng, et al.
Publicado: (2026)
por: Xie, Yiweng, et al.
Publicado: (2026)
AgentVLN: Towards Agentic Vision-and-Language Navigation
por: Xin, Zihao, et al.
Publicado: (2026)
por: Xin, Zihao, et al.
Publicado: (2026)
HiCoTraj:Zero-Shot Demographic Reasoning via Hierarchical Chain-of-Thought Prompting from Trajectory
por: Xie, Junyi, et al.
Publicado: (2025)
por: Xie, Junyi, et al.
Publicado: (2025)
HiKER-SGG: Hierarchical Knowledge Enhanced Robust Scene Graph Generation
por: Zhang, Ce, et al.
Publicado: (2024)
por: Zhang, Ce, et al.
Publicado: (2024)
MemRec: Collaborative Memory-Augmented Agentic Recommender System
por: Chen, Weixin, et al.
Publicado: (2026)
por: Chen, Weixin, et al.
Publicado: (2026)
MemRepair: Hierarchical Memory for Agentic Repository-Level Vulnerability Repair
por: Liu, Simiao, et al.
Publicado: (2026)
por: Liu, Simiao, et al.
Publicado: (2026)
MemForest: An Efficient Agent Memory System with Hierarchical Temporal Indexing
por: Chen, Han, et al.
Publicado: (2026)
por: Chen, Han, et al.
Publicado: (2026)
OpenVLN: Open-world Aerial Vision-Language Navigation
por: Lin, Peican, et al.
Publicado: (2025)
por: Lin, Peican, et al.
Publicado: (2025)
AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation
por: Guo, Wenxuan, et al.
Publicado: (2026)
por: Guo, Wenxuan, et al.
Publicado: (2026)
HiAgent: Hierarchical Working Memory Management for Solving Long-Horizon Agent Tasks with Large Language Model
por: Hu, Mengkang, et al.
Publicado: (2024)
por: Hu, Mengkang, et al.
Publicado: (2024)
Mind the Gap: Aligning Vision Foundation Models to Image Feature Matching
por: Liu, Yuhan, et al.
Publicado: (2025)
por: Liu, Yuhan, et al.
Publicado: (2025)
Semantic-aware Representation Learning for Homography Estimation
por: Liu, Yuhan, et al.
Publicado: (2024)
por: Liu, Yuhan, et al.
Publicado: (2024)
Hi-GMAE: Hierarchical Graph Masked Autoencoders
por: Liu, Chuang, et al.
Publicado: (2024)
por: Liu, Chuang, et al.
Publicado: (2024)
Ejemplares similares
-
Dual-Anchoring: Addressing State Drift in Vision-Language Navigation
por: Wu, Kangyi, et al.
Publicado: (2026) -
REGNav: Room Expert Guided Image-Goal Navigation
por: Li, Pengna, et al.
Publicado: (2025) -
SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation
por: Li, Pengna, et al.
Publicado: (2026) -
Think before Go: Hierarchical Reasoning for Image-goal Navigation
por: Li, Pengna, et al.
Publicado: (2026) -
BrainMem: Brain-Inspired Evolving Memory for Embodied Agent Task Planning
por: Ma, Xiaoyu, et al.
Publicado: (2026)