CLASH: Collaborative Large-Small Hierarchical Framework for Continuous Vision-and-Language Navigation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Liuyi, He, Zongtao, Li, Jinlong, Xia, Ruihao, Hu, Mengxian, Yao, Chenpeng, Liu, Chengju, Tang, Yang, Chen, Qijun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MLANet: Multi-Level Attention Network with Sub-instruction for Continuous Vision-and-Language Navigation
par: He, Zongtao, et autres
Publié: (2023)
par: He, Zongtao, et autres
Publié: (2023)
Vision-and-Language Navigation via Causal Learning
par: Wang, Liuyi, et autres
Publié: (2024)
par: Wang, Liuyi, et autres
Publié: (2024)
MAGIC: Meta-Ability Guided Interactive Chain-of-Distillation for Effective-and-Efficient Vision-and-Language Navigation
par: Wang, Liuyi, et autres
Publié: (2024)
par: Wang, Liuyi, et autres
Publié: (2024)
Causality-based Cross-Modal Representation Learning for Vision-and-Language Navigation
par: Wang, Liuyi, et autres
Publié: (2024)
par: Wang, Liuyi, et autres
Publié: (2024)
NavComposer: Composing Language Instructions for Navigation Trajectories through Action-Scene-Object Modularization
par: He, Zongtao, et autres
Publié: (2025)
par: He, Zongtao, et autres
Publié: (2025)
P2DNav: Panorama-to-Downview Reasoning for Zero-shot Vision-and-Language Navigation
par: Sheng, Kai, et autres
Publié: (2026)
par: Sheng, Kai, et autres
Publié: (2026)
A Dual Semantic-Aware Recurrent Global-Adaptive Network For Vision-and-Language Navigation
par: Wang, Liuyi, et autres
Publié: (2023)
par: Wang, Liuyi, et autres
Publié: (2023)
Realizing Text-Driven Motion Generation on NAO Robot: A Reinforcement Learning-Optimized Control Pipeline
par: Xu, Zihan, et autres
Publié: (2025)
par: Xu, Zihan, et autres
Publié: (2025)
PASTS: Progress-Aware Spatio-Temporal Transformer Speaker For Vision-and-Language Navigation
par: Wang, Liuyi, et autres
Publié: (2023)
par: Wang, Liuyi, et autres
Publié: (2023)
Rethinking the Embodied Gap in Vision-and-Language Navigation: A Holistic Study of Physical and Visual Disparities
par: Wang, Liuyi, et autres
Publié: (2025)
par: Wang, Liuyi, et autres
Publié: (2025)
Dynamics Are Learned, Not Told: Semi-Supervised Discovery of Latent Dynamics Geometries For Zero-Shot Policy Adaptation
par: Xu, Zhiming, et autres
Publié: (2026)
par: Xu, Zhiming, et autres
Publié: (2026)
Vision-Language Navigation for Aerial Robots: Towards the Era of Large Language Models
par: Xia, Xingyu, et autres
Publié: (2026)
par: Xia, Xingyu, et autres
Publié: (2026)
Trajectory Planning and Tracking of Hybrid Flying-Crawling Quadrotors
par: Hu, Dongnan, et autres
Publié: (2023)
par: Hu, Dongnan, et autres
Publié: (2023)
Adaptive Denoising-Enhanced LiDAR Odometry for Degeneration Resilience in Diverse Terrains
par: Ji, Mazeyu, et autres
Publié: (2023)
par: Ji, Mazeyu, et autres
Publié: (2023)
Kinematics-Aware Multi-Policy Reinforcement Learning for Force-Capable Humanoid Loco-Manipulation
par: Xiao, Kaiyan, et autres
Publié: (2025)
par: Xiao, Kaiyan, et autres
Publié: (2025)
ECHO: Continuous Hierarchical Memory for Vision-Language-Action Models
par: Hu, Yanbin, et autres
Publié: (2026)
par: Hu, Yanbin, et autres
Publié: (2026)
Deconfounded Lifelong Learning for Autonomous Driving via Dynamic Knowledge Spaces
par: Du, Jiayuan, et autres
Publié: (2026)
par: Du, Jiayuan, et autres
Publié: (2026)
Cog-GA: A Large Language Models-based Generative Agent for Vision-Language Navigation in Continuous Environments
par: Li, Zhiyuan, et autres
Publié: (2024)
par: Li, Zhiyuan, et autres
Publié: (2024)
CLASH: Collision Learning via Augmented Sim-to-real Hybridization to Bridge the Reality Gap
par: He, Haotian, et autres
Publié: (2026)
par: He, Haotian, et autres
Publié: (2026)
Vision-Language Navigation with Continual Learning
par: Li, Zhiyuan, et autres
Publié: (2024)
par: Li, Zhiyuan, et autres
Publié: (2024)
Lookahead Exploration with Neural Radiance Representation for Continuous Vision-Language Navigation
par: Wang, Zihan, et autres
Publié: (2024)
par: Wang, Zihan, et autres
Publié: (2024)
A Deployable Embodied Vision-Language Navigation System with Hierarchical Cognition and Context-Aware Exploration
par: Xu, Kuan, et autres
Publié: (2026)
par: Xu, Kuan, et autres
Publié: (2026)
LaViRA: Language-Vision-Robot Actions Translation for Zero-Shot Vision Language Navigation in Continuous Environments
par: Ding, Hongyu, et autres
Publié: (2025)
par: Ding, Hongyu, et autres
Publié: (2025)
Temporal-Guided Visual Foundation Models for Event-Based Vision
par: Xia, Ruihao, et autres
Publié: (2025)
par: Xia, Ruihao, et autres
Publié: (2025)
SeqWalker: Sequential-Horizon Vision-and-Language Navigation with Hierarchical Planning
par: Han, Zebin, et autres
Publié: (2026)
par: Han, Zebin, et autres
Publié: (2026)
DeCoNav: Dialog enhanced Long-Horizon Collaborative Vision-Language Navigation
par: Zhou, Sunyao, et autres
Publié: (2026)
par: Zhou, Sunyao, et autres
Publié: (2026)
IndoorUAV: Benchmarking Vision-Language UAV Navigation in Continuous Indoor Environments
par: Liu, Xu, et autres
Publié: (2025)
par: Liu, Xu, et autres
Publié: (2025)
VLNVerse: A Benchmark for Vision-Language Navigation with Versatile, Embodied, Realistic Simulation and Evaluation
par: Lin, Sihao, et autres
Publié: (2025)
par: Lin, Sihao, et autres
Publié: (2025)
CL-CoTNav: Closed-Loop Hierarchical Chain-of-Thought for Zero-Shot Object-Goal Navigation with Vision-Language Models
par: Cai, Yuxin, et autres
Publié: (2025)
par: Cai, Yuxin, et autres
Publié: (2025)
Does Peer Observation Help? Vision-Sharing Collaboration for Vision-Language Navigation
par: Jin, Qunchao, et autres
Publié: (2026)
par: Jin, Qunchao, et autres
Publié: (2026)
ImagineUAV: Aerial Vision-Language Navigation via World-Action Modeling and Kinodynamic Planning
par: Liu, Xuchen, et autres
Publié: (2026)
par: Liu, Xuchen, et autres
Publié: (2026)
FSR-VLN: Fast and Slow Reasoning for Vision-Language Navigation with Hierarchical Multi-modal Scene Graph
par: Zhou, Xiaolin, et autres
Publié: (2025)
par: Zhou, Xiaolin, et autres
Publié: (2025)
Hierarchical Semantic-Augmented Navigation: Optimal Transport and Graph-Driven Reasoning for Vision-Language Navigation
par: Fang, Xiang, et autres
Publié: (2026)
par: Fang, Xiang, et autres
Publié: (2026)
ETPNav: Evolving Topological Planning for Vision-Language Navigation in Continuous Environments
par: An, Dong, et autres
Publié: (2023)
par: An, Dong, et autres
Publié: (2023)
HiMemVLN: Enhancing Reliability of Open-Source Zero-Shot Vision-and-Language Navigation with Hierarchical Memory System
par: Lyu, Kailin, et autres
Publié: (2026)
par: Lyu, Kailin, et autres
Publié: (2026)
SFCo-Nav: Efficient Zero-Shot Visual Language Navigation via Collaboration of Slow LLM and Fast Attributed Graph Alignment
par: Xiong, Chaoran, et autres
Publié: (2026)
par: Xiong, Chaoran, et autres
Publié: (2026)
Safe-VLN: Collision Avoidance for Vision-and-Language Navigation of Autonomous Robots Operating in Continuous Environments
par: Yue, Lu, et autres
Publié: (2023)
par: Yue, Lu, et autres
Publié: (2023)
HTNav: A Hybrid Navigation Framework with Tiered Structure for Urban Aerial Vision-and-Language Navigation
par: Fan, Chengjie, et autres
Publié: (2026)
par: Fan, Chengjie, et autres
Publié: (2026)
Affordances-Oriented Planning using Foundation Models for Continuous Vision-Language Navigation
par: Chen, Jiaqi, et autres
Publié: (2024)
par: Chen, Jiaqi, et autres
Publié: (2024)
ImagineNav: Prompting Vision-Language Models as Embodied Navigator through Scene Imagination
par: Zhao, Xinxin, et autres
Publié: (2024)
par: Zhao, Xinxin, et autres
Publié: (2024)
Documents similaires
-
MLANet: Multi-Level Attention Network with Sub-instruction for Continuous Vision-and-Language Navigation
par: He, Zongtao, et autres
Publié: (2023) -
Vision-and-Language Navigation via Causal Learning
par: Wang, Liuyi, et autres
Publié: (2024) -
MAGIC: Meta-Ability Guided Interactive Chain-of-Distillation for Effective-and-Efficient Vision-and-Language Navigation
par: Wang, Liuyi, et autres
Publié: (2024) -
Causality-based Cross-Modal Representation Learning for Vision-and-Language Navigation
par: Wang, Liuyi, et autres
Publié: (2024) -
NavComposer: Composing Language Instructions for Navigation Trajectories through Action-Scene-Object Modularization
par: He, Zongtao, et autres
Publié: (2025)