VL-LN Bench: Towards Long-horizon Goal-oriented Navigation with Active Dialogs
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Wensi, Zhu, Shaohao, Wei, Meng, Xu, Jinming, Liu, Xihui, Wang, Hanqing, Wang, Tai, Zhao, Feng, Pang, Jiangmiao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
OVExp: Open Vocabulary Exploration for Object-Oriented Navigation
di: Wei, Meng, et al.
Pubblicazione: (2024)
di: Wei, Meng, et al.
Pubblicazione: (2024)
StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling
di: Wei, Meng, et al.
Pubblicazione: (2025)
di: Wei, Meng, et al.
Pubblicazione: (2025)
NavDP: Learning Sim-to-Real Navigation Diffusion Policy with Privileged Information Guidance
di: Cai, Wenzhe, et al.
Pubblicazione: (2025)
di: Cai, Wenzhe, et al.
Pubblicazione: (2025)
Ground Slow, Move Fast: A Dual-System Foundation Model for Generalizable Vision-and-Language Navigation
di: Wei, Meng, et al.
Pubblicazione: (2025)
di: Wei, Meng, et al.
Pubblicazione: (2025)
Towards Latency-Aware 3D Streaming Perception for Autonomous Driving
di: Peng, Jiaqi, et al.
Pubblicazione: (2025)
di: Peng, Jiaqi, et al.
Pubblicazione: (2025)
UniGoal: Towards Universal Zero-shot Goal-oriented Navigation
di: Yin, Hang, et al.
Pubblicazione: (2025)
di: Yin, Hang, et al.
Pubblicazione: (2025)
Rethinking the Embodied Gap in Vision-and-Language Navigation: A Holistic Study of Physical and Visual Disparities
di: Wang, Liuyi, et al.
Pubblicazione: (2025)
di: Wang, Liuyi, et al.
Pubblicazione: (2025)
GenNBV: Generalizable Next-Best-View Policy for Active 3D Reconstruction
di: Chen, Xiao, et al.
Pubblicazione: (2024)
di: Chen, Xiao, et al.
Pubblicazione: (2024)
GLEAM: Learning Generalizable Exploration Policy for Active Mapping in Complex 3D Indoor Scenes
di: Chen, Xiao, et al.
Pubblicazione: (2025)
di: Chen, Xiao, et al.
Pubblicazione: (2025)
LoGoPlanner: Localization Grounded Navigation Policy with Metric-aware Visual Geometry
di: Peng, Jiaqi, et al.
Pubblicazione: (2025)
di: Peng, Jiaqi, et al.
Pubblicazione: (2025)
GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation
di: Gao, Ning, et al.
Pubblicazione: (2025)
di: Gao, Ning, et al.
Pubblicazione: (2025)
CronusVLA: Towards Efficient and Robust Manipulation via Multi-Frame Vision-Language-Action Modeling
di: Li, Hao, et al.
Pubblicazione: (2025)
di: Li, Hao, et al.
Pubblicazione: (2025)
Tac2Real: Reliable and GPU Visuotactile Simulation for Online Reinforcement Learning and Zero-Shot Real-World Deployment
di: Yan, Ningyu, et al.
Pubblicazione: (2026)
di: Yan, Ningyu, et al.
Pubblicazione: (2026)
InstructVLA: Vision-Language-Action Instruction Tuning from Understanding to Manipulation
di: Yang, Shuai, et al.
Pubblicazione: (2025)
di: Yang, Shuai, et al.
Pubblicazione: (2025)
Multimodal Perception for Goal-oriented Navigation: A Survey
di: Ieong, I-Tak, et al.
Pubblicazione: (2025)
di: Ieong, I-Tak, et al.
Pubblicazione: (2025)
DeCoNav: Dialog enhanced Long-Horizon Collaborative Vision-Language Navigation
di: Zhou, Sunyao, et al.
Pubblicazione: (2026)
di: Zhou, Sunyao, et al.
Pubblicazione: (2026)
EfficientNav: Towards On-Device Object-Goal Navigation with Navigation Map Caching and Retrieval
di: Yang, Zebin, et al.
Pubblicazione: (2025)
di: Yang, Zebin, et al.
Pubblicazione: (2025)
VLM-Grounder: A VLM Agent for Zero-Shot 3D Visual Grounding
di: Xu, Runsen, et al.
Pubblicazione: (2024)
di: Xu, Runsen, et al.
Pubblicazione: (2024)
ON as ALC: Active Loop Closing Object Goal Navigation
di: Iwata, Daiki, et al.
Pubblicazione: (2024)
di: Iwata, Daiki, et al.
Pubblicazione: (2024)
MAexp: A Generic Platform for RL-based Multi-Agent Exploration
di: Zhu, Shaohao, et al.
Pubblicazione: (2024)
di: Zhu, Shaohao, et al.
Pubblicazione: (2024)
RoboInter: A Holistic Intermediate Representation Suite Towards Robotic Manipulation
di: Li, Hao, et al.
Pubblicazione: (2026)
di: Li, Hao, et al.
Pubblicazione: (2026)
Uncertainty-Informed Active Perception for Open Vocabulary Object Goal Navigation
di: Bajpai, Utkarsh, et al.
Pubblicazione: (2025)
di: Bajpai, Utkarsh, et al.
Pubblicazione: (2025)
Aerial World Model for Long-horizon Visual Generation and Navigation in 3D Space
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
Safe Multi-Agent Navigation guided by Goal-Conditioned Safe Reinforcement Learning
di: Feng, Meng, et al.
Pubblicazione: (2025)
di: Feng, Meng, et al.
Pubblicazione: (2025)
MCNav: Memory-Aware Dynamic Cognitive Map for Zero-shot Goal-oriented Navigation
di: Li, Jingyu, et al.
Pubblicazione: (2026)
di: Li, Jingyu, et al.
Pubblicazione: (2026)
Demystifying Action Space Design for Robotic Manipulation Policies
di: Feng, Yuchun, et al.
Pubblicazione: (2026)
di: Feng, Yuchun, et al.
Pubblicazione: (2026)
Goal Inference from Open-Ended Dialog
di: Ma, Rachel, et al.
Pubblicazione: (2024)
di: Ma, Rachel, et al.
Pubblicazione: (2024)
GA-TEB: Goal-Adaptive Framework for Efficient Navigation Based on Goal Lines
di: Zhang, Qianyi, et al.
Pubblicazione: (2024)
di: Zhang, Qianyi, et al.
Pubblicazione: (2024)
Long Range Navigator (LRN): Extending robot planning horizons beyond metric maps
di: Schmittle, Matt, et al.
Pubblicazione: (2025)
di: Schmittle, Matt, et al.
Pubblicazione: (2025)
ActiveVLN: Towards Active Exploration via Multi-Turn RL in Vision-and-Language Navigation
di: Zhang, Zekai, et al.
Pubblicazione: (2025)
di: Zhang, Zekai, et al.
Pubblicazione: (2025)
AR Forcing: Towards Long-Horizon Robot Navigation World Model
di: Yang, Yifei, et al.
Pubblicazione: (2026)
di: Yang, Yifei, et al.
Pubblicazione: (2026)
OST-Bench: Evaluating the Capabilities of MLLMs in Online Spatio-temporal Scene Understanding
di: Lin, Jingli, et al.
Pubblicazione: (2025)
di: Lin, Jingli, et al.
Pubblicazione: (2025)
VLNVerse: A Benchmark for Vision-Language Navigation with Versatile, Embodied, Realistic Simulation and Evaluation
di: Lin, Sihao, et al.
Pubblicazione: (2025)
di: Lin, Sihao, et al.
Pubblicazione: (2025)
RoboKeyGen: Robot Pose and Joint Angles Estimation via Diffusion-based 3D Keypoint Generation
di: Tian, Yang, et al.
Pubblicazione: (2024)
di: Tian, Yang, et al.
Pubblicazione: (2024)
Safety-aware Goal-oriented Semantic Sensing, Communication, and Control for Robotics
di: Wu, Wenchao, et al.
Pubblicazione: (2026)
di: Wu, Wenchao, et al.
Pubblicazione: (2026)
MORN: Metacognitive Object-Goal Regulation for Resource-Rational Long-Horizon Navigation
di: Lin, Xi, et al.
Pubblicazione: (2026)
di: Lin, Xi, et al.
Pubblicazione: (2026)
TeleOpBench: A Simulator-Centric Benchmark for Dual-Arm Dexterous Teleoperation
di: Li, Hangyu, et al.
Pubblicazione: (2025)
di: Li, Hangyu, et al.
Pubblicazione: (2025)
Feel Robot Feels: Tactile Feedback Array Glove for Dexterous Manipulation
di: Jia, Feiyu, et al.
Pubblicazione: (2026)
di: Jia, Feiyu, et al.
Pubblicazione: (2026)
InternScenes: A Large-scale Simulatable Indoor Scene Dataset with Realistic Layouts
di: Zhong, Weipeng, et al.
Pubblicazione: (2025)
di: Zhong, Weipeng, et al.
Pubblicazione: (2025)
An Efficient and Multi-Modal Navigation System with One-Step World Model
di: Shen, Wangtian, et al.
Pubblicazione: (2026)
di: Shen, Wangtian, et al.
Pubblicazione: (2026)
Documenti analoghi
-
OVExp: Open Vocabulary Exploration for Object-Oriented Navigation
di: Wei, Meng, et al.
Pubblicazione: (2024) -
StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling
di: Wei, Meng, et al.
Pubblicazione: (2025) -
NavDP: Learning Sim-to-Real Navigation Diffusion Policy with Privileged Information Guidance
di: Cai, Wenzhe, et al.
Pubblicazione: (2025) -
Ground Slow, Move Fast: A Dual-System Foundation Model for Generalizable Vision-and-Language Navigation
di: Wei, Meng, et al.
Pubblicazione: (2025) -
Towards Latency-Aware 3D Streaming Perception for Autonomous Driving
di: Peng, Jiaqi, et al.
Pubblicazione: (2025)