P$^{3}$Nav: End-to-End Perception, Prediction and Planning for Vision-and-Language Navigation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Tianfu, Chen, Wenbo, Xu, Haoxuan, Zheng, Xinhu, Li, Haoang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing Vision-Language Navigation with Multimodal Event Knowledge from Real-World Indoor Tour Videos
par: Xu, Haoxuan, et autres
Publié: (2026)
par: Xu, Haoxuan, et autres
Publié: (2026)
HCSG: Human-Centric Semantic-Geometric Reasoning for Vision-Language Navigation
par: Xu, Haoxuan, et autres
Publié: (2026)
par: Xu, Haoxuan, et autres
Publié: (2026)
SkyVLN: Vision-and-Language Navigation and NMPC Control for UAVs in Urban Environments
par: Li, Tianshun, et autres
Publié: (2025)
par: Li, Tianshun, et autres
Publié: (2025)
A Physics-informed End-to-End Occupancy Framework for Motion Planning of Autonomous Vehicles
par: Shen, Shuqi, et autres
Publié: (2025)
par: Shen, Shuqi, et autres
Publié: (2025)
X-Nav: Learning End-to-End Cross-Embodiment Navigation for Mobile Robots
par: Wang, Haitong, et autres
Publié: (2025)
par: Wang, Haitong, et autres
Publié: (2025)
RoboTron-Nav: A Unified Framework for Embodied Navigation Integrating Perception, Planning, and Prediction
par: Zhong, Yufeng, et autres
Publié: (2025)
par: Zhong, Yufeng, et autres
Publié: (2025)
SPAN-Nav: Generalized Spatial Awareness for Versatile Vision-Language Navigation
par: Liu, Jiahang, et autres
Publié: (2026)
par: Liu, Jiahang, et autres
Publié: (2026)
DR. Nav: Semantic-Geometric Representations for Proactive Dead-End Recovery and Navigation
par: Rajagopal, Vignesh, et autres
Publié: (2025)
par: Rajagopal, Vignesh, et autres
Publié: (2025)
Utilizing Navigation Paths to Generate Target Points for Enhanced End-to-End Autonomous Driving Planning
par: Shen, Yuanhua, et autres
Publié: (2024)
par: Shen, Yuanhua, et autres
Publié: (2024)
PIE: Perception and Interaction Enhanced End-to-End Motion Planning for Autonomous Driving
par: Yuan, Chengran, et autres
Publié: (2025)
par: Yuan, Chengran, et autres
Publié: (2025)
CityNavAgent: Aerial Vision-and-Language Navigation with Hierarchical Semantic Planning and Global Memory
par: Zhang, Weichen, et autres
Publié: (2025)
par: Zhang, Weichen, et autres
Publié: (2025)
YOPOv2-Tracker: An End-to-End Agile Tracking and Navigation Framework from Perception to Action
par: Lu, Junjie, et autres
Publié: (2025)
par: Lu, Junjie, et autres
Publié: (2025)
Fast-SmartWay: Panoramic-Free End-to-End Zero-Shot Vision-and-Language Navigation
par: Shi, Xiangyu, et autres
Publié: (2025)
par: Shi, Xiangyu, et autres
Publié: (2025)
UAV-VLN: End-to-End Vision Language guided Navigation for UAVs
par: Saxena, Pranav, et autres
Publié: (2025)
par: Saxena, Pranav, et autres
Publié: (2025)
AERR-Nav: Adaptive Exploration-Recovery-Reminiscing Strategy for Zero-Shot Object Navigation
par: Huang, Jingzhi, et autres
Publié: (2026)
par: Huang, Jingzhi, et autres
Publié: (2026)
Robust Energy-Aware Routing for Air-Ground Cooperative Multi-UAV Delivery in Wind-Uncertain Environments
par: Li, Tianshun, et autres
Publié: (2026)
par: Li, Tianshun, et autres
Publié: (2026)
Nav-SCOPE: Swarm Robot Cooperative Perception and Coordinated Navigation
par: Li, Chenxi, et autres
Publié: (2024)
par: Li, Chenxi, et autres
Publié: (2024)
DeCoNav: Dialog enhanced Long-Horizon Collaborative Vision-Language Navigation
par: Zhou, Sunyao, et autres
Publié: (2026)
par: Zhou, Sunyao, et autres
Publié: (2026)
NavForesee: A Unified Vision-Language World Model for Hierarchical Planning and Dual-Horizon Navigation Prediction
par: Liu, Fei, et autres
Publié: (2025)
par: Liu, Fei, et autres
Publié: (2025)
FlowVLA: Visual Chain of Thought-based Motion Reasoning for Vision-Language-Action Models
par: Zhong, Zhide, et autres
Publié: (2025)
par: Zhong, Zhide, et autres
Publié: (2025)
AdaNav: Adaptive Reasoning with Uncertainty for Vision-Language Navigation
par: Ding, Xin, et autres
Publié: (2025)
par: Ding, Xin, et autres
Publié: (2025)
Bridging Perception and Planning: Towards End-to-End Planning for Signal Temporal Logic Tasks
par: Ye, Bowen, et autres
Publié: (2025)
par: Ye, Bowen, et autres
Publié: (2025)
NavThinker: Action-Conditioned World Models for Coupled Prediction and Planning in Social Navigation
par: Hu, Tianshuai, et autres
Publié: (2026)
par: Hu, Tianshuai, et autres
Publié: (2026)
DVDP: An End-to-End Policy for Mobile Robot Visual Docking with RGB-D Perception
par: Min, Haohan, et autres
Publié: (2025)
par: Min, Haohan, et autres
Publié: (2025)
Agile in the Face of Delay: Asynchronous End-to-End Learning for Real-World Aerial Navigation
par: Li, Yude, et autres
Publié: (2025)
par: Li, Yude, et autres
Publié: (2025)
SocialNav-Map: Dynamic Mapping with Human Trajectory Prediction for Zero-Shot Social Navigation
par: Zhang, Lingfeng, et autres
Publié: (2025)
par: Zhang, Lingfeng, et autres
Publié: (2025)
AppleVLM: End-to-end Autonomous Driving with Advanced Perception and Planning-Enhanced Vision-Language Models
par: Han, Yuxuan, et autres
Publié: (2026)
par: Han, Yuxuan, et autres
Publié: (2026)
RAP: 3D Rasterization Augmented End-to-End Planning
par: Feng, Lan, et autres
Publié: (2025)
par: Feng, Lan, et autres
Publié: (2025)
X-MOBILITY: End-To-End Generalizable Navigation via World Modeling
par: Liu, Wei, et autres
Publié: (2024)
par: Liu, Wei, et autres
Publié: (2024)
End-to-End Navigation with Vision Language Models: Transforming Spatial Reasoning into Question-Answering
par: Goetting, Dylan, et autres
Publié: (2024)
par: Goetting, Dylan, et autres
Publié: (2024)
Bridging Past and Future: End-to-End Autonomous Driving with Historical Prediction and Planning
par: Zhang, Bozhou, et autres
Publié: (2025)
par: Zhang, Bozhou, et autres
Publié: (2025)
$NavA^3$: Understanding Any Instruction, Navigating Anywhere, Finding Anything
par: Zhang, Lingfeng, et autres
Publié: (2025)
par: Zhang, Lingfeng, et autres
Publié: (2025)
DyGeoVLN: Infusing Dynamic Geometry Foundation Model into Vision-Language Navigation
par: Liu, Xiangchen, et autres
Publié: (2026)
par: Liu, Xiangchen, et autres
Publié: (2026)
SEDualVLN: A Spatially-Enhanced Dual-System for Vision-Language Navigation
par: Huang, Jingzhi, et autres
Publié: (2026)
par: Huang, Jingzhi, et autres
Publié: (2026)
TinyNav: End-to-End TinyML for Real-Time Autonomous Navigation on Microcontrollers
par: Roy, Pooria, et autres
Publié: (2026)
par: Roy, Pooria, et autres
Publié: (2026)
Embodied Escaping: End-to-End Reinforcement Learning for Robot Navigation in Narrow Environment
par: Zheng, Han, et autres
Publié: (2025)
par: Zheng, Han, et autres
Publié: (2025)
AerialVLA: A Vision-Language-Action Model for UAV Navigation via Minimalist End-to-End Control
par: Xu, Peng, et autres
Publié: (2026)
par: Xu, Peng, et autres
Publié: (2026)
IDOL: Inverse-Dynamics-Guided Future Prediction for End-to-End Autonomous Driving
par: Zhang, Chenghao, et autres
Publié: (2026)
par: Zhang, Chenghao, et autres
Publié: (2026)
NeuPAN: Direct Point Robot Navigation with End-to-End Model-based Learning
par: Han, Ruihua, et autres
Publié: (2024)
par: Han, Ruihua, et autres
Publié: (2024)
Interactive Navigation for Legged Manipulators with Learned Arm-Pushing Controller
par: Bi, Zhihai, et autres
Publié: (2025)
par: Bi, Zhihai, et autres
Publié: (2025)
Documents similaires
-
Enhancing Vision-Language Navigation with Multimodal Event Knowledge from Real-World Indoor Tour Videos
par: Xu, Haoxuan, et autres
Publié: (2026) -
HCSG: Human-Centric Semantic-Geometric Reasoning for Vision-Language Navigation
par: Xu, Haoxuan, et autres
Publié: (2026) -
SkyVLN: Vision-and-Language Navigation and NMPC Control for UAVs in Urban Environments
par: Li, Tianshun, et autres
Publié: (2025) -
A Physics-informed End-to-End Occupancy Framework for Motion Planning of Autonomous Vehicles
par: Shen, Shuqi, et autres
Publié: (2025) -
X-Nav: Learning End-to-End Cross-Embodiment Navigation for Mobile Robots
par: Wang, Haitong, et autres
Publié: (2025)