OVExp: Open Vocabulary Exploration for Object-Oriented Navigation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wei, Meng, Wang, Tai, Chen, Yilun, Wang, Hanqing, Pang, Jiangmiao, Liu, Xihui |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VL-LN Bench: Towards Long-horizon Goal-oriented Navigation with Active Dialogs
par: Huang, Wensi, et autres
Publié: (2025)
par: Huang, Wensi, et autres
Publié: (2025)
NavDP: Learning Sim-to-Real Navigation Diffusion Policy with Privileged Information Guidance
par: Cai, Wenzhe, et autres
Publié: (2025)
par: Cai, Wenzhe, et autres
Publié: (2025)
StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling
par: Wei, Meng, et autres
Publié: (2025)
par: Wei, Meng, et autres
Publié: (2025)
Rethinking the Embodied Gap in Vision-and-Language Navigation: A Holistic Study of Physical and Visual Disparities
par: Wang, Liuyi, et autres
Publié: (2025)
par: Wang, Liuyi, et autres
Publié: (2025)
Ground Slow, Move Fast: A Dual-System Foundation Model for Generalizable Vision-and-Language Navigation
par: Wei, Meng, et autres
Publié: (2025)
par: Wei, Meng, et autres
Publié: (2025)
OpenObject-NAV: Open-Vocabulary Object-Oriented Navigation Based on Dynamic Carrier-Relationship Scene Graph
par: Tang, Yujie, et autres
Publié: (2024)
par: Tang, Yujie, et autres
Publié: (2024)
OpenIN: Open-Vocabulary Instance-Oriented Navigation in Dynamic Domestic Environments
par: Tang, Yujie, et autres
Publié: (2025)
par: Tang, Yujie, et autres
Publié: (2025)
GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation
par: Gao, Ning, et autres
Publié: (2025)
par: Gao, Ning, et autres
Publié: (2025)
OVAL: Open-Vocabulary Augmented Memory Model for Lifelong Object Goal Navigation
par: Pei, Jiahua, et autres
Publié: (2026)
par: Pei, Jiahua, et autres
Publié: (2026)
VLM-Grounder: A VLM Agent for Zero-Shot 3D Visual Grounding
par: Xu, Runsen, et autres
Publié: (2024)
par: Xu, Runsen, et autres
Publié: (2024)
InstructVLA: Vision-Language-Action Instruction Tuning from Understanding to Manipulation
par: Yang, Shuai, et autres
Publié: (2025)
par: Yang, Shuai, et autres
Publié: (2025)
LOVON: Legged Open-Vocabulary Object Navigator
par: Peng, Daojie, et autres
Publié: (2025)
par: Peng, Daojie, et autres
Publié: (2025)
CronusVLA: Towards Efficient and Robust Manipulation via Multi-Frame Vision-Language-Action Modeling
par: Li, Hao, et autres
Publié: (2025)
par: Li, Hao, et autres
Publié: (2025)
GLEAM: Learning Generalizable Exploration Policy for Active Mapping in Complex 3D Indoor Scenes
par: Chen, Xiao, et autres
Publié: (2025)
par: Chen, Xiao, et autres
Publié: (2025)
LoGoPlanner: Localization Grounded Navigation Policy with Metric-aware Visual Geometry
par: Peng, Jiaqi, et autres
Publié: (2025)
par: Peng, Jiaqi, et autres
Publié: (2025)
OVSegDT: Segmenting Transformer for Open-Vocabulary Object Goal Navigation
par: Zemskova, Tatiana, et autres
Publié: (2025)
par: Zemskova, Tatiana, et autres
Publié: (2025)
Uncertainty-Informed Active Perception for Open Vocabulary Object Goal Navigation
par: Bajpai, Utkarsh, et autres
Publié: (2025)
par: Bajpai, Utkarsh, et autres
Publié: (2025)
CooHOI: Learning Cooperative Human-Object Interaction with Manipulated Object Dynamics
par: Gao, Jiawei, et autres
Publié: (2024)
par: Gao, Jiawei, et autres
Publié: (2024)
Towards Latency-Aware 3D Streaming Perception for Autonomous Driving
par: Peng, Jiaqi, et autres
Publié: (2025)
par: Peng, Jiaqi, et autres
Publié: (2025)
GoalSwarm: Multi-UAV Semantic Coordination for Open-Vocabulary Object Navigation
par: James, MoniJesu Wonders, et autres
Publié: (2026)
par: James, MoniJesu Wonders, et autres
Publié: (2026)
Tac2Real: Reliable and GPU Visuotactile Simulation for Online Reinforcement Learning and Zero-Shot Real-World Deployment
par: Yan, Ningyu, et autres
Publié: (2026)
par: Yan, Ningyu, et autres
Publié: (2026)
Language-to-Space Programming for Training-Free 3D Visual Grounding
par: Mi, Boyu, et autres
Publié: (2025)
par: Mi, Boyu, et autres
Publié: (2025)
DIV-Nav: Open-Vocabulary Spatial Relationships for Multi-Object Navigation
par: Ortega-Peimbert, Jesús, et autres
Publié: (2025)
par: Ortega-Peimbert, Jesús, et autres
Publié: (2025)
DOZE: A Dataset for Open-Vocabulary Zero-Shot Object Navigation in Dynamic Environments
par: Ma, Ji, et autres
Publié: (2024)
par: Ma, Ji, et autres
Publié: (2024)
RoboGround: Robotic Manipulation with Grounded Vision-Language Priors
par: Huang, Haifeng, et autres
Publié: (2025)
par: Huang, Haifeng, et autres
Publié: (2025)
AffordGrasp: In-Context Affordance Reasoning for Open-Vocabulary Task-Oriented Grasping in Clutter
par: Tang, Yingbo, et autres
Publié: (2025)
par: Tang, Yingbo, et autres
Publié: (2025)
A Data-Centric Revisit of Pre-Trained Vision Models for Robot Learning
par: Wen, Xin, et autres
Publié: (2025)
par: Wen, Xin, et autres
Publié: (2025)
GenNBV: Generalizable Next-Best-View Policy for Active 3D Reconstruction
par: Chen, Xiao, et autres
Publié: (2024)
par: Chen, Xiao, et autres
Publié: (2024)
GLOVER: Generalizable Open-Vocabulary Affordance Reasoning for Task-Oriented Grasping
par: Ma, Teli, et autres
Publié: (2024)
par: Ma, Teli, et autres
Publié: (2024)
Gripper Keypose and Object Pointflow as Interfaces for Bimanual Robotic Manipulation
par: Yang, Yuyin, et autres
Publié: (2025)
par: Yang, Yuyin, et autres
Publié: (2025)
RoboInter: A Holistic Intermediate Representation Suite Towards Robotic Manipulation
par: Li, Hao, et autres
Publié: (2026)
par: Li, Hao, et autres
Publié: (2026)
HM3D-OVON: A Dataset and Benchmark for Open-Vocabulary Object Goal Navigation
par: Yokoyama, Naoki, et autres
Publié: (2024)
par: Yokoyama, Naoki, et autres
Publié: (2024)
OVAMOS: A Framework for Open-Vocabulary Multi-Object Search in Unknown Environments
par: Wang, Qianwei, et autres
Publié: (2025)
par: Wang, Qianwei, et autres
Publié: (2025)
Re$^3$Sim: Generating High-Fidelity Simulation Data via 3D-Photorealistic Real-to-Sim for Robotic Manipulation
par: Han, Xiaoshen, et autres
Publié: (2025)
par: Han, Xiaoshen, et autres
Publié: (2025)
OVAL-Grasp: Open-Vocabulary Affordance Localization for Task Oriented Grasping
par: Tong, Edmond, et autres
Publié: (2025)
par: Tong, Edmond, et autres
Publié: (2025)
VLNVerse: A Benchmark for Vision-Language Navigation with Versatile, Embodied, Realistic Simulation and Evaluation
par: Lin, Sihao, et autres
Publié: (2025)
par: Lin, Sihao, et autres
Publié: (2025)
Articulate AnyMesh: Open-Vocabulary 3D Articulated Objects Modeling
par: Qiu, Xiaowen, et autres
Publié: (2025)
par: Qiu, Xiaowen, et autres
Publié: (2025)
Object-Oriented Semantic Mapping for Reliable UAVs Navigation
par: Canh, Thanh Nguyen, et autres
Publié: (2024)
par: Canh, Thanh Nguyen, et autres
Publié: (2024)
VISTA: Open-Vocabulary, Task-Relevant Robot Exploration with Online Semantic Gaussian Splatting
par: Nagami, Keiko, et autres
Publié: (2025)
par: Nagami, Keiko, et autres
Publié: (2025)
FindAnything: Open-Vocabulary and Object-Centric Mapping for Robot Exploration in Any Environment
par: Laina, Sebastián Barbas, et autres
Publié: (2025)
par: Laina, Sebastián Barbas, et autres
Publié: (2025)
Documents similaires
-
VL-LN Bench: Towards Long-horizon Goal-oriented Navigation with Active Dialogs
par: Huang, Wensi, et autres
Publié: (2025) -
NavDP: Learning Sim-to-Real Navigation Diffusion Policy with Privileged Information Guidance
par: Cai, Wenzhe, et autres
Publié: (2025) -
StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling
par: Wei, Meng, et autres
Publié: (2025) -
Rethinking the Embodied Gap in Vision-and-Language Navigation: A Holistic Study of Physical and Visual Disparities
par: Wang, Liuyi, et autres
Publié: (2025) -
Ground Slow, Move Fast: A Dual-System Foundation Model for Generalizable Vision-and-Language Navigation
par: Wei, Meng, et autres
Publié: (2025)