ImagineUAV: Aerial Vision-Language Navigation via World-Action Modeling and Kinodynamic Planning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Xuchen, Huang, Jiawei, Xia, Shihao, Liu, Bingxi, Cui, Jinqiang, Yang, Jiankun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CityNavAgent: Aerial Vision-and-Language Navigation with Hierarchical Semantic Planning and Global Memory
par: Zhang, Weichen, et autres
Publié: (2025)
par: Zhang, Weichen, et autres
Publié: (2025)
WorldVLN: Autoregressive World Action Model for Aerial Vision-Language Navigation
par: Zhao, Baining, et autres
Publié: (2026)
par: Zhao, Baining, et autres
Publié: (2026)
Kinodynamic Motion Planning for Mobile Robot Navigation across Inconsistent World Models
par: Damm, Eric R., et autres
Publié: (2025)
par: Damm, Eric R., et autres
Publié: (2025)
UAV-Track VLA: Embodied Aerial Tracking via Vision-Language-Action Models
par: Zhang, Qiyao, et autres
Publié: (2026)
par: Zhang, Qiyao, et autres
Publié: (2026)
AutoFly: Vision-Language-Action Model for UAV Autonomous Navigation in the Wild
par: Sun, Xiaolou, et autres
Publié: (2026)
par: Sun, Xiaolou, et autres
Publié: (2026)
AerialVLA: A Vision-Language-Action Model for UAV Navigation via Minimalist End-to-End Control
par: Xu, Peng, et autres
Publié: (2026)
par: Xu, Peng, et autres
Publié: (2026)
VISTAv2: World Imagination for Indoor Vision-and-Language Navigation
par: Huang, Yanjia, et autres
Publié: (2025)
par: Huang, Yanjia, et autres
Publié: (2025)
FloorPlan-VLN: A New Paradigm for Floor Plan Guided Vision-Language Navigation
par: Chen, Kehan, et autres
Publié: (2026)
par: Chen, Kehan, et autres
Publié: (2026)
VISTA: Generative Visual Imagination for Vision-and-Language Navigation
par: Huang, Yanjia, et autres
Publié: (2025)
par: Huang, Yanjia, et autres
Publié: (2025)
Vision-Language Navigation for Aerial Robots: Towards the Era of Large Language Models
par: Xia, Xingyu, et autres
Publié: (2026)
par: Xia, Xingyu, et autres
Publié: (2026)
IndoorUAV: Benchmarking Vision-Language UAV Navigation in Continuous Indoor Environments
par: Liu, Xu, et autres
Publié: (2025)
par: Liu, Xu, et autres
Publié: (2025)
OpenVLN: Open-world Aerial Vision-Language Navigation
par: Lin, Peican, et autres
Publié: (2025)
par: Lin, Peican, et autres
Publié: (2025)
ImagineNav: Prompting Vision-Language Models as Embodied Navigator through Scene Imagination
par: Zhao, Xinxin, et autres
Publié: (2024)
par: Zhao, Xinxin, et autres
Publié: (2024)
ImagineNav++: Prompting Vision-Language Models as Embodied Navigator through Scene Imagination
par: Wang, Teng, et autres
Publié: (2025)
par: Wang, Teng, et autres
Publié: (2025)
Imaginative World Modeling with Scene Graphs for Embodied Agent Navigation
par: Hu, Yue, et autres
Publié: (2025)
par: Hu, Yue, et autres
Publié: (2025)
SwordRiding: A Unified Navigation Framework for Quadrotors in Unknown Complex Environments via Online Guiding Vector Fields
par: Liu, Xuchen, et autres
Publié: (2025)
par: Liu, Xuchen, et autres
Publié: (2025)
Planning from Imagination: Episodic Simulation and Episodic Memory for Vision-and-Language Navigation
par: Pan, Yiyuan, et autres
Publié: (2024)
par: Pan, Yiyuan, et autres
Publié: (2024)
TextInPlace: Indoor Visual Place Recognition in Repetitive Structures with Scene Text Spotting and Verification
par: Tao, Huaqi, et autres
Publié: (2025)
par: Tao, Huaqi, et autres
Publié: (2025)
SIMPACT: Simulation-Enabled Action Planning using Vision-Language Models
par: Liu, Haowen, et autres
Publié: (2025)
par: Liu, Haowen, et autres
Publié: (2025)
AIR-VLA: Vision-Language-Action Systems for Aerial Manipulation
par: Sun, Jianli, et autres
Publié: (2026)
par: Sun, Jianli, et autres
Publié: (2026)
UAV-ON: A Benchmark for Open-World Object Goal Navigation with Aerial Agents
par: Xiao, Jianqiang, et autres
Publié: (2025)
par: Xiao, Jianqiang, et autres
Publié: (2025)
HTNav: A Hybrid Navigation Framework with Tiered Structure for Urban Aerial Vision-and-Language Navigation
par: Fan, Chengjie, et autres
Publié: (2026)
par: Fan, Chengjie, et autres
Publié: (2026)
World-Value-Action Model: Implicit Planning for Vision-Language-Action Systems
par: Li, Runze, et autres
Publié: (2026)
par: Li, Runze, et autres
Publié: (2026)
VLA-AN: An Efficient and Onboard Vision-Language-Action Framework for Aerial Navigation in Complex Environments
par: Wu, Yuze, et autres
Publié: (2025)
par: Wu, Yuze, et autres
Publié: (2025)
Ultrafast Sampling-based Kinodynamic Planning via Differential Flatness
par: Duong, Thai, et autres
Publié: (2026)
par: Duong, Thai, et autres
Publié: (2026)
Online Time-Informed Kinodynamic Motion Planning of Nonlinear Systems
par: Meng, Fei, et autres
Publié: (2024)
par: Meng, Fei, et autres
Publié: (2024)
Safety Assurance for Quadrotor Kinodynamic Motion Planning
par: Tavoulareas, Theodoros, et autres
Publié: (2025)
par: Tavoulareas, Theodoros, et autres
Publié: (2025)
TIC-VLA: A Think-in-Control Vision-Language-Action Model for Robot Navigation in Dynamic Environments
par: Huang, Zhiyu, et autres
Publié: (2026)
par: Huang, Zhiyu, et autres
Publié: (2026)
When to Trust Imagination: Adaptive Action Execution for World Action Models
par: Wang, Rui, et autres
Publié: (2026)
par: Wang, Rui, et autres
Publié: (2026)
UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation
par: Sautenkov, Oleg, et autres
Publié: (2025)
par: Sautenkov, Oleg, et autres
Publié: (2025)
Towards Realistic UAV Vision-Language Navigation: Platform, Benchmark, and Methodology
par: Wang, Xiangyu, et autres
Publié: (2024)
par: Wang, Xiangyu, et autres
Publié: (2024)
NavThinker: Action-Conditioned World Models for Coupled Prediction and Planning in Social Navigation
par: Hu, Tianshuai, et autres
Publié: (2026)
par: Hu, Tianshuai, et autres
Publié: (2026)
NaVILA: Legged Robot Vision-Language-Action Model for Navigation
par: Cheng, An-Chieh, et autres
Publié: (2024)
par: Cheng, An-Chieh, et autres
Publié: (2024)
Self-Correcting VLA: Online Action Refinement via Sparse World Imagination
par: Liu, Chenyv, et autres
Publié: (2026)
par: Liu, Chenyv, et autres
Publié: (2026)
Dream to Recall: Imagination-Guided Experience Retrieval for Memory-Persistent Vision-and-Language Navigation
par: Xu, Yunzhe, et autres
Publié: (2025)
par: Xu, Yunzhe, et autres
Publié: (2025)
Survey of Vision-Language-Action Models for Embodied Manipulation
par: Li, Haoran, et autres
Publié: (2025)
par: Li, Haoran, et autres
Publié: (2025)
TrackingMiM: Efficient Mamba-in-Mamba Serialization for Real-time UAV Object Tracking
par: Liu, Bingxi, et autres
Publié: (2025)
par: Liu, Bingxi, et autres
Publié: (2025)
Object-Centric Kinodynamic Planning for Nonprehensile Robot Rearrangement Manipulation
par: Ren, Kejia, et autres
Publié: (2024)
par: Ren, Kejia, et autres
Publié: (2024)
Accelerating db-A* for Kinodynamic Motion Planning Using Diffusion
par: Franke, Julius, et autres
Publié: (2025)
par: Franke, Julius, et autres
Publié: (2025)
Multi-layer Motion Planning with Kinodynamic and Spatio-Temporal Constraints
par: Chatrola, Jeel, et autres
Publié: (2025)
par: Chatrola, Jeel, et autres
Publié: (2025)
Documents similaires
-
CityNavAgent: Aerial Vision-and-Language Navigation with Hierarchical Semantic Planning and Global Memory
par: Zhang, Weichen, et autres
Publié: (2025) -
WorldVLN: Autoregressive World Action Model for Aerial Vision-Language Navigation
par: Zhao, Baining, et autres
Publié: (2026) -
Kinodynamic Motion Planning for Mobile Robot Navigation across Inconsistent World Models
par: Damm, Eric R., et autres
Publié: (2025) -
UAV-Track VLA: Embodied Aerial Tracking via Vision-Language-Action Models
par: Zhang, Qiyao, et autres
Publié: (2026) -
AutoFly: Vision-Language-Action Model for UAV Autonomous Navigation in the Wild
par: Sun, Xiaolou, et autres
Publié: (2026)