ViSA-Enhanced Aerial VLN: A Visual-Spatial Reasoning Enhanced Framework for Aerial Vision-Language Navigation
Fuente:
arXiv
Salvato in:
| Autori principali: | Tong, Haoyu, Dong, Xiangyu, Ma, Xiaoguang, Zhao, Haoran, Zhou, Yaoming, Lin, Chenghao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CMMR-VLN: Vision-and-Language Navigation via Continual Multimodal Memory Retrieval
di: Li, Haozhou, et al.
Pubblicazione: (2026)
di: Li, Haozhou, et al.
Pubblicazione: (2026)
SE-VLN: A Self-Evolving Vision-Language Navigation Framework Based on Multimodal Large Language Models
di: Dong, Xiangyu, et al.
Pubblicazione: (2025)
di: Dong, Xiangyu, et al.
Pubblicazione: (2025)
LightZeroNav: Zero-Shot Vision Language Navigation in Continuous Environments Based on Lightweight VLMs
di: Luo, Kun, et al.
Pubblicazione: (2026)
di: Luo, Kun, et al.
Pubblicazione: (2026)
LookasideVLN: Direction-Aware Aerial Vision-and-Language Navigation
di: Ning, Yuwei, et al.
Pubblicazione: (2026)
di: Ning, Yuwei, et al.
Pubblicazione: (2026)
OpenVLN: Open-world Aerial Vision-Language Navigation
di: Lin, Peican, et al.
Pubblicazione: (2025)
di: Lin, Peican, et al.
Pubblicazione: (2025)
Exploring Spatial Representation to Enhance LLM Reasoning in Aerial Vision-Language Navigation
di: Gao, Yunpeng, et al.
Pubblicazione: (2024)
di: Gao, Yunpeng, et al.
Pubblicazione: (2024)
WorldVLN: Autoregressive World Action Model for Aerial Vision-Language Navigation
di: Zhao, Baining, et al.
Pubblicazione: (2026)
di: Zhao, Baining, et al.
Pubblicazione: (2026)
PM-Nav: Priori-Map Guided Embodied Navigation in Functional Buildings
di: Gao, Jiang, et al.
Pubblicazione: (2026)
di: Gao, Jiang, et al.
Pubblicazione: (2026)
ViSA: 3D-Aware Video Shading for Real-Time Upper-Body Avatar Creation
di: Yang, Fan, et al.
Pubblicazione: (2025)
di: Yang, Fan, et al.
Pubblicazione: (2025)
Aerial Vision-Language Navigation with a Unified Framework for Spatial, Temporal and Embodied Reasoning
di: Xu, Huilin, et al.
Pubblicazione: (2025)
di: Xu, Huilin, et al.
Pubblicazione: (2025)
AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation
di: Guo, Wenxuan, et al.
Pubblicazione: (2026)
di: Guo, Wenxuan, et al.
Pubblicazione: (2026)
SEDualVLN: A Spatially-Enhanced Dual-System for Vision-Language Navigation
di: Huang, Jingzhi, et al.
Pubblicazione: (2026)
di: Huang, Jingzhi, et al.
Pubblicazione: (2026)
ViSA: Visited-State Augmentation for Generalized Goal-Space Contrastive Reinforcement Learning
di: Nakamura, Issa, et al.
Pubblicazione: (2026)
di: Nakamura, Issa, et al.
Pubblicazione: (2026)
History-Enhanced Two-Stage Transformer for Aerial Vision-and-Language Navigation
di: Ding, Xichen, et al.
Pubblicazione: (2025)
di: Ding, Xichen, et al.
Pubblicazione: (2025)
SUM-AgriVLN: Spatial Understanding Memory for Agricultural Vision-and-Language Navigation
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
GC-VLN: Instruction as Graph Constraints for Training-free Vision-and-Language Navigation
di: Yin, Hang, et al.
Pubblicazione: (2025)
di: Yin, Hang, et al.
Pubblicazione: (2025)
Spatial-VLN: Zero-Shot Vision-and-Language Navigation With Explicit Spatial Perception and Exploration
di: Yue, Lu, et al.
Pubblicazione: (2026)
di: Yue, Lu, et al.
Pubblicazione: (2026)
FantasyVLN: Unified Multimodal Chain-of-Thought Reasoning for Vision-Language Navigation
di: Zuo, Jing, et al.
Pubblicazione: (2026)
di: Zuo, Jing, et al.
Pubblicazione: (2026)
AgriVLN: Vision-and-Language Navigation for Agricultural Robots
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
VLN-MME: Diagnosing MLLMs as Language-guided Visual Navigation agents
di: Zhao, Xunyi, et al.
Pubblicazione: (2025)
di: Zhao, Xunyi, et al.
Pubblicazione: (2025)
ViSA-Flow: Accelerating Robot Skill Learning via Large-Scale Video Semantic Action Flow
di: Chen, Changhe, et al.
Pubblicazione: (2025)
di: Chen, Changhe, et al.
Pubblicazione: (2025)
DecoVLN: Decoupling Observation, Reasoning, and Correction for Vision-and-Language Navigation
di: Xin, Zihao, et al.
Pubblicazione: (2026)
di: Xin, Zihao, et al.
Pubblicazione: (2026)
VLA-AN: An Efficient and Onboard Vision-Language-Action Framework for Aerial Navigation in Complex Environments
di: Wu, Yuze, et al.
Pubblicazione: (2025)
di: Wu, Yuze, et al.
Pubblicazione: (2025)
HTNav: A Hybrid Navigation Framework with Tiered Structure for Urban Aerial Vision-and-Language Navigation
di: Fan, Chengjie, et al.
Pubblicazione: (2026)
di: Fan, Chengjie, et al.
Pubblicazione: (2026)
Vision-Language Navigation for Aerial Robots: Towards the Era of Large Language Models
di: Xia, Xingyu, et al.
Pubblicazione: (2026)
di: Xia, Xingyu, et al.
Pubblicazione: (2026)
AeroDuo: Aerial Duo for UAV-based Vision and Language Navigation
di: Wu, Ruipu, et al.
Pubblicazione: (2025)
di: Wu, Ruipu, et al.
Pubblicazione: (2025)
Open-Text Aerial Detection: A Unified Framework For Aerial Visual Grounding And Detection
di: Wei, Guoting, et al.
Pubblicazione: (2026)
di: Wei, Guoting, et al.
Pubblicazione: (2026)
Aerial Vision-and-Language Navigation with Grid-based View Selection and Map Construction
di: Zhao, Ganlong, et al.
Pubblicazione: (2025)
di: Zhao, Ganlong, et al.
Pubblicazione: (2025)
JanusVLN: Decoupling Semantics and Spatiality with Dual Implicit Memory for Vision-Language Navigation
di: Zeng, Shuang, et al.
Pubblicazione: (2025)
di: Zeng, Shuang, et al.
Pubblicazione: (2025)
ViVa-SAFELAND: a New Freeware for Safe Validation of Vision-based Navigation in Aerial Vehicles
di: Soriano-García, Miguel S., et al.
Pubblicazione: (2025)
di: Soriano-García, Miguel S., et al.
Pubblicazione: (2025)
AgentVLN: Towards Agentic Vision-and-Language Navigation
di: Xin, Zihao, et al.
Pubblicazione: (2026)
di: Xin, Zihao, et al.
Pubblicazione: (2026)
UnitedVLN: Generalizable Gaussian Splatting for Continuous Vision-Language Navigation
di: Dai, Guangzhao, et al.
Pubblicazione: (2024)
di: Dai, Guangzhao, et al.
Pubblicazione: (2024)
T-araVLN: Translator for Agricultural Robotic Agents on Vision-and-Language Navigation
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
MSNav: Zero-Shot Vision-and-Language Navigation with Dynamic Memory and LLM Spatial Reasoning
di: Liu, Chenghao, et al.
Pubblicazione: (2025)
di: Liu, Chenghao, et al.
Pubblicazione: (2025)
Enhancing Fine-grained Object Detection in Aerial Images via Orthogonal Mapping
di: Zhu, Haoran, et al.
Pubblicazione: (2024)
di: Zhu, Haoran, et al.
Pubblicazione: (2024)
FSR-VLN: Fast and Slow Reasoning for Vision-Language Navigation with Hierarchical Multi-modal Scene Graph
di: Zhou, Xiaolin, et al.
Pubblicazione: (2025)
di: Zhou, Xiaolin, et al.
Pubblicazione: (2025)
MDE-AgriVLN: Agricultural Vision-and-Language Navigation with Monocular Depth Estimation
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
di: Zhao, Xiaobei, et al.
Pubblicazione: (2025)
DyGeoVLN: Infusing Dynamic Geometry Foundation Model into Vision-Language Navigation
di: Liu, Xiangchen, et al.
Pubblicazione: (2026)
di: Liu, Xiangchen, et al.
Pubblicazione: (2026)
DV-VLN: Dual Verification for Reliable LLM-Based Vision-and-Language Navigation
di: Li, Zijun, et al.
Pubblicazione: (2026)
di: Li, Zijun, et al.
Pubblicazione: (2026)
VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning
di: Qi, Zhangyang, et al.
Pubblicazione: (2025)
di: Qi, Zhangyang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
CMMR-VLN: Vision-and-Language Navigation via Continual Multimodal Memory Retrieval
di: Li, Haozhou, et al.
Pubblicazione: (2026) -
SE-VLN: A Self-Evolving Vision-Language Navigation Framework Based on Multimodal Large Language Models
di: Dong, Xiangyu, et al.
Pubblicazione: (2025) -
LightZeroNav: Zero-Shot Vision Language Navigation in Continuous Environments Based on Lightweight VLMs
di: Luo, Kun, et al.
Pubblicazione: (2026) -
LookasideVLN: Direction-Aware Aerial Vision-and-Language Navigation
di: Ning, Yuwei, et al.
Pubblicazione: (2026) -
OpenVLN: Open-world Aerial Vision-Language Navigation
di: Lin, Peican, et al.
Pubblicazione: (2025)