Language-Conditioned World Modeling for Visual Navigation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dong, Yifei, Wu, Fengyi, Dai, Yilong, Kong, Lingdong, Chen, Guangyu, Zhu, Xu, Hu, Qiyu, Wang, Tianyu, Garnica, Johnalbert, Liu, Feng, Huang, Siyu, Dai, Qi, Cheng, Zhi-Qi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Unified World Models for Visual Navigation via Memory-Augmented Planning and Foresight
par: Dong, Yifei, et autres
Publié: (2025)
par: Dong, Yifei, et autres
Publié: (2025)
GoViG: Goal-Conditioned Visual Navigation Instruction Generation via Multimodal Reasoning
par: Wu, Fengyi, et autres
Publié: (2025)
par: Wu, Fengyi, et autres
Publié: (2025)
Securing the Skies: A Comprehensive Survey on Anti-UAV Methods, Benchmarking, and Future Directions
par: Dong, Yifei, et autres
Publié: (2025)
par: Dong, Yifei, et autres
Publié: (2025)
NavThinker: Action-Conditioned World Models for Coupled Prediction and Planning in Social Navigation
par: Hu, Tianshuai, et autres
Publié: (2026)
par: Hu, Tianshuai, et autres
Publié: (2026)
HA-VLN 2.0: An Open Benchmark and Leaderboard for Human-Aware Navigation in Discrete and Continuous Environments with Dynamic Multi-Human Interactions
par: Dong, Yifei, et autres
Publié: (2025)
par: Dong, Yifei, et autres
Publié: (2025)
Human-Aware Vision-and-Language Navigation: Bridging Simulation to Reality with Dynamic Human Interactions
par: Li, Heng, et autres
Publié: (2024)
par: Li, Heng, et autres
Publié: (2024)
Recursive Visual Imagination and Adaptive Linguistic Grounding for Vision Language Navigation
par: Chen, Bolei, et autres
Publié: (2025)
par: Chen, Bolei, et autres
Publié: (2025)
Universal Online Temporal Calibration for Optimization-based Visual-Inertial Navigation Systems
par: Fan, Yunfei, et autres
Publié: (2025)
par: Fan, Yunfei, et autres
Publié: (2025)
Policy-Guided World Model Planning for Language-Conditioned Visual Navigation
par: Chahe, Amirhosein, et autres
Publié: (2026)
par: Chahe, Amirhosein, et autres
Publié: (2026)
Zero-Shot 3D Visual Grounding from Vision-Language Models
par: Li, Rong, et autres
Publié: (2025)
par: Li, Rong, et autres
Publié: (2025)
ACDC: Adaptive Curriculum Planning with Dynamic Contrastive Control for Goal-Conditioned Reinforcement Learning in Robotic Manipulation
par: Wang, Xuerui, et autres
Publié: (2026)
par: Wang, Xuerui, et autres
Publié: (2026)
MG-Nav: Dual-Scale Visual Navigation via Sparse Spatial Memory
par: Wang, Bo, et autres
Publié: (2025)
par: Wang, Bo, et autres
Publié: (2025)
FLUX: Accelerating Cross-Embodiment Generative Navigation Policies via Rectified Flow and Static-to-Dynamic Learning
par: Gong, Zeying, et autres
Publié: (2026)
par: Gong, Zeying, et autres
Publié: (2026)
VLN-MME: Diagnosing MLLMs as Language-guided Visual Navigation agents
par: Zhao, Xunyi, et autres
Publié: (2025)
par: Zhao, Xunyi, et autres
Publié: (2025)
Lifelong Embodied Navigation Learning
par: Wang, Xudong, et autres
Publié: (2026)
par: Wang, Xudong, et autres
Publié: (2026)
Stairway to Success: An Online Floor-Aware Zero-Shot Object-Goal Navigation Framework via LLM-Driven Coarse-to-Fine Exploration
par: Gong, Zeying, et autres
Publié: (2025)
par: Gong, Zeying, et autres
Publié: (2025)
SeqWalker: Sequential-Horizon Vision-and-Language Navigation with Hierarchical Planning
par: Han, Zebin, et autres
Publié: (2026)
par: Han, Zebin, et autres
Publié: (2026)
Aerial World Model for Long-horizon Visual Generation and Navigation in 3D Space
par: Zhang, Weichen, et autres
Publié: (2025)
par: Zhang, Weichen, et autres
Publié: (2025)
Visual SLAM with DEM Anchoring for Lunar Surface Navigation
par: Dai, Adam, et autres
Publié: (2026)
par: Dai, Adam, et autres
Publié: (2026)
LiveVLN: Breaking the Stop-and-Go Loop in Vision-Language Navigation
par: Wang, Xiangchen, et autres
Publié: (2026)
par: Wang, Xiangchen, et autres
Publié: (2026)
From Words to Safety: Language-Conditioned Safety Filtering for Robot Navigation
par: Feng, Zeyuan, et autres
Publié: (2025)
par: Feng, Zeyuan, et autres
Publié: (2025)
LagMemo: Language 3D Gaussian Splatting Memory for Multi-modal Open-vocabulary Multi-goal Visual Navigation
par: Zhou, Haotian, et autres
Publié: (2025)
par: Zhou, Haotian, et autres
Publié: (2025)
History-Conditioned Spatio-Temporal Visual Token Pruning for Efficient Vision-Language Navigation
par: Wang, Qitong, et autres
Publié: (2026)
par: Wang, Qitong, et autres
Publié: (2026)
SeeGround: See and Ground for Zero-Shot Open-Vocabulary 3D Visual Grounding
par: Li, Rong, et autres
Publié: (2024)
par: Li, Rong, et autres
Publié: (2024)
One Agent to Guide Them All: Empowering MLLMs for Vision-and-Language Navigation via Explicit World Representation
par: Li, Zerui, et autres
Publié: (2026)
par: Li, Zerui, et autres
Publié: (2026)
Robust Control of An Aerial Manipulator Based on A Variable Inertia Parameters Model
par: Zhang, Guangyu, et autres
Publié: (2024)
par: Zhang, Guangyu, et autres
Publié: (2024)
BadNAVer: Exploring Jailbreak Attacks On Vision-and-Language Navigation
par: Lyu, Wenqi, et autres
Publié: (2025)
par: Lyu, Wenqi, et autres
Publié: (2025)
Keyframe-Based Feed-Forward Visual Odometry
par: Dai, Weichen, et autres
Publié: (2026)
par: Dai, Weichen, et autres
Publié: (2026)
VLPG-Nav: Object Navigation Using Visual Language Pose Graph and Object Localization Probability Maps
par: Arul, Senthil Hariharan, et autres
Publié: (2024)
par: Arul, Senthil Hariharan, et autres
Publié: (2024)
Language Conditioned Multi-Finger Dexterous Manipulation Enabled by Physical Compliance and Switching of Controllers
par: Pan, Cheng, et autres
Publié: (2024)
par: Pan, Cheng, et autres
Publié: (2024)
SPAN-Nav: Generalized Spatial Awareness for Versatile Vision-Language Navigation
par: Liu, Jiahang, et autres
Publié: (2026)
par: Liu, Jiahang, et autres
Publié: (2026)
Visual Grounding from Event Cameras
par: Kong, Lingdong, et autres
Publié: (2025)
par: Kong, Lingdong, et autres
Publié: (2025)
Think, Act, and Ask: Open-World Interactive Personalized Robot Navigation
par: Dai, Yinpei, et autres
Publié: (2023)
par: Dai, Yinpei, et autres
Publié: (2023)
AutoSpatial: Visual-Language Reasoning for Social Robot Navigation through Efficient Spatial Reasoning Learning
par: Kong, Yangzhe, et autres
Publié: (2025)
par: Kong, Yangzhe, et autres
Publié: (2025)
Are VLMs Ready for Autonomous Driving? An Empirical Study from the Reliability, Data, and Metric Perspectives
par: Xie, Shaoyuan, et autres
Publié: (2025)
par: Xie, Shaoyuan, et autres
Publié: (2025)
LCLA: Language-Conditioned Latent Alignment for Vision-Language Navigation
par: Subedi, Nitesh, et autres
Publié: (2026)
par: Subedi, Nitesh, et autres
Publié: (2026)
Square-Root Inverse Filter-based GNSS-Visual-Inertial Navigation
par: Hu, Jun, et autres
Publié: (2024)
par: Hu, Jun, et autres
Publié: (2024)
MM-Nav: Multi-View VLA Model for Robust Visual Navigation via Multi-Expert Learning
par: Xu, Tianyu, et autres
Publié: (2025)
par: Xu, Tianyu, et autres
Publié: (2025)
Is Your LiDAR Placement Optimized for 3D Scene Understanding?
par: Li, Ye, et autres
Publié: (2024)
par: Li, Ye, et autres
Publié: (2024)
A Hetero-Associative Sequential Memory Model Utilizing Neuromorphic Signals: Validated on a Mobile Manipulator
par: Wang, Runcong, et autres
Publié: (2025)
par: Wang, Runcong, et autres
Publié: (2025)
Documents similaires
-
Towards Unified World Models for Visual Navigation via Memory-Augmented Planning and Foresight
par: Dong, Yifei, et autres
Publié: (2025) -
GoViG: Goal-Conditioned Visual Navigation Instruction Generation via Multimodal Reasoning
par: Wu, Fengyi, et autres
Publié: (2025) -
Securing the Skies: A Comprehensive Survey on Anti-UAV Methods, Benchmarking, and Future Directions
par: Dong, Yifei, et autres
Publié: (2025) -
NavThinker: Action-Conditioned World Models for Coupled Prediction and Planning in Social Navigation
par: Hu, Tianshuai, et autres
Publié: (2026) -
HA-VLN 2.0: An Open Benchmark and Leaderboard for Human-Aware Navigation in Discrete and Continuous Environments with Dynamic Multi-Human Interactions
par: Dong, Yifei, et autres
Publié: (2025)