OSMa-Bench++: Toward Open-Ended Benchmarking of Semantic Mapping for Manipulation with Prompt-Generated Synthetic Scenes
Fuente:
arXiv
Salvato in:
| Autori principali: | Kurkova, Regina, Popov, Maxim, Kolyubin, Sergey |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
OSMa-Bench: Evaluating Open Semantic Mapping Under Varying Lighting Conditions
di: Popov, Maxim, et al.
Pubblicazione: (2025)
di: Popov, Maxim, et al.
Pubblicazione: (2025)
AgentGrounder: Zero-Shot 3D Visual Pointcloud Grounding using Multimodal Language Models
di: Huynh, Cuong, et al.
Pubblicazione: (2026)
di: Huynh, Cuong, et al.
Pubblicazione: (2026)
R5DGS: Semantic-Aware 4D Gaussian Splatting with Rigid Body Constraints for Efficient Dynamic Scene Reconstruction
di: Gridusov, Denis, et al.
Pubblicazione: (2026)
di: Gridusov, Denis, et al.
Pubblicazione: (2026)
RADIO-ViPE: Online Tightly Coupled Multi-Modal Fusion for Open-Vocabulary Semantic SLAM in Dynamic Environments
di: Nasser, Zaid, et al.
Pubblicazione: (2026)
di: Nasser, Zaid, et al.
Pubblicazione: (2026)
DualMap: Online Open-Vocabulary Semantic Mapping for Natural Language Navigation in Dynamic Changing Scenes
di: Jiang, Jiajun, et al.
Pubblicazione: (2025)
di: Jiang, Jiajun, et al.
Pubblicazione: (2025)
OpenESS: Event-based Semantic Scene Understanding with Open Vocabularies
di: Kong, Lingdong, et al.
Pubblicazione: (2024)
di: Kong, Lingdong, et al.
Pubblicazione: (2024)
Open-Vocabulary Online Semantic Mapping for SLAM
di: Martins, Tomas Berriel, et al.
Pubblicazione: (2024)
di: Martins, Tomas Berriel, et al.
Pubblicazione: (2024)
M3Bench: Benchmarking Whole-body Motion Generation for Mobile Manipulation in 3D Scenes
di: Zhang, Zeyu, et al.
Pubblicazione: (2024)
di: Zhang, Zeyu, et al.
Pubblicazione: (2024)
ArtiBench and ArtiBrain: Benchmarking Generalizable Vision-Language Articulated Object Manipulation
di: Wu, Yuhan, et al.
Pubblicazione: (2025)
di: Wu, Yuhan, et al.
Pubblicazione: (2025)
KM-ViPE: Online Tightly Coupled Vision-Language-Geometry Fusion for Open-Vocabulary Semantic SLAM
di: Nasser, Zaid, et al.
Pubblicazione: (2025)
di: Nasser, Zaid, et al.
Pubblicazione: (2025)
Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking
di: Liu, Yun, et al.
Pubblicazione: (2024)
di: Liu, Yun, et al.
Pubblicazione: (2024)
Open-vocabulary Mobile Manipulation in Unseen Dynamic Environments with 3D Semantic Maps
di: Qiu, Dicong, et al.
Pubblicazione: (2024)
di: Qiu, Dicong, et al.
Pubblicazione: (2024)
GOTPR: General Outdoor Text-based Place Recognition Using Scene Graph Retrieval with OpenStreetMap
di: Jung, Donghwi, et al.
Pubblicazione: (2025)
di: Jung, Donghwi, et al.
Pubblicazione: (2025)
QueSTMaps: Queryable Semantic Topological Maps for 3D Scene Understanding
di: Mehan, Yash, et al.
Pubblicazione: (2024)
di: Mehan, Yash, et al.
Pubblicazione: (2024)
SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes
di: Qiu, Dicong, et al.
Pubblicazione: (2025)
di: Qiu, Dicong, et al.
Pubblicazione: (2025)
DISC: Dense Integrated Semantic Context for Large-Scale Open-Set Semantic Mapping
di: Igelbrink, Felix, et al.
Pubblicazione: (2026)
di: Igelbrink, Felix, et al.
Pubblicazione: (2026)
PhenoBench -- A Large Dataset and Benchmarks for Semantic Image Interpretation in the Agricultural Domain
di: Weyler, Jan, et al.
Pubblicazione: (2023)
di: Weyler, Jan, et al.
Pubblicazione: (2023)
Lift, Splat, Map: Lifting Foundation Masks for Label-Free Semantic Scene Completion
di: Zhang, Arthur, et al.
Pubblicazione: (2024)
di: Zhang, Arthur, et al.
Pubblicazione: (2024)
RoboTrustBench: Benchmarking the Trustworthiness of Video World Models for Robotic Manipulation
di: Li, Huiqiong, et al.
Pubblicazione: (2026)
di: Li, Huiqiong, et al.
Pubblicazione: (2026)
Towards Open-World Mobile Manipulation in Homes: Lessons from the Neurips 2023 HomeRobot Open Vocabulary Mobile Manipulation Challenge
di: Yenamandra, Sriram, et al.
Pubblicazione: (2024)
di: Yenamandra, Sriram, et al.
Pubblicazione: (2024)
OpenLex3D: A Tiered Evaluation Benchmark for Open-Vocabulary 3D Scene Representations
di: Kassab, Christina, et al.
Pubblicazione: (2025)
di: Kassab, Christina, et al.
Pubblicazione: (2025)
LOSS-SLAM: Lightweight Open-Set Semantic Simultaneous Localization and Mapping
di: Singh, Kurran, et al.
Pubblicazione: (2024)
di: Singh, Kurran, et al.
Pubblicazione: (2024)
Open-Ended Instruction Realization with LLM-Enabled Multi-Planner Scheduling in Autonomous Vehicles
di: Liu, Jiawei, et al.
Pubblicazione: (2026)
di: Liu, Jiawei, et al.
Pubblicazione: (2026)
AnyScene: Towards Highly Controllable Driving Scene Generation at Anywhere and Beyond
di: Zhang, Haiming, et al.
Pubblicazione: (2026)
di: Zhang, Haiming, et al.
Pubblicazione: (2026)
GSplatLoc: Grounding Keypoint Descriptors into 3D Gaussian Splatting for Improved Visual Localization
di: Sidorov, Gennady, et al.
Pubblicazione: (2024)
di: Sidorov, Gennady, et al.
Pubblicazione: (2024)
DeformGS: Scene Flow in Highly Deformable Scenes for Deformable Object Manipulation
di: Duisterhof, Bardienus P., et al.
Pubblicazione: (2023)
di: Duisterhof, Bardienus P., et al.
Pubblicazione: (2023)
Recasting Generic Pretrained Vision Transformers As Object-Centric Scene Encoders For Manipulation Policies
di: Qian, Jianing, et al.
Pubblicazione: (2024)
di: Qian, Jianing, et al.
Pubblicazione: (2024)
MapBERT: Bitwise Masked Modeling for Real-Time Semantic Mapping Generation
di: Deng, Yijie, et al.
Pubblicazione: (2025)
di: Deng, Yijie, et al.
Pubblicazione: (2025)
Articulated 3D Scene Graphs for Open-World Mobile Manipulation
di: Büchner, Martin, et al.
Pubblicazione: (2026)
di: Büchner, Martin, et al.
Pubblicazione: (2026)
SCENEREPLICA: Benchmarking Real-World Robot Manipulation by Creating Replicable Scenes
di: Khargonkar, Ninad, et al.
Pubblicazione: (2023)
di: Khargonkar, Ninad, et al.
Pubblicazione: (2023)
LangMap: A Human-Verified Benchmark for Hierarchical Open-Vocabulary Goal Navigation
di: Miao, Bo, et al.
Pubblicazione: (2026)
di: Miao, Bo, et al.
Pubblicazione: (2026)
Bench2Drive: Towards Multi-Ability Benchmarking of Closed-Loop End-To-End Autonomous Driving
di: Jia, Xiaosong, et al.
Pubblicazione: (2024)
di: Jia, Xiaosong, et al.
Pubblicazione: (2024)
WildScenes: A Benchmark for 2D and 3D Semantic Segmentation in Large-scale Natural Environments
di: Vidanapathirana, Kavisha, et al.
Pubblicazione: (2023)
di: Vidanapathirana, Kavisha, et al.
Pubblicazione: (2023)
DivScene: Towards Open-Vocabulary Object Navigation with Large Vision Language Models in Diverse Scenes
di: Wang, Zhaowei, et al.
Pubblicazione: (2024)
di: Wang, Zhaowei, et al.
Pubblicazione: (2024)
Zero-shot Reconstruction of In-Scene Object Manipulation from Video
di: Lin, Dixuan, et al.
Pubblicazione: (2025)
di: Lin, Dixuan, et al.
Pubblicazione: (2025)
SemanticVLA: Semantic-Aligned Sparsification and Enhancement for Efficient Robotic Manipulation
di: Li, Wei, et al.
Pubblicazione: (2025)
di: Li, Wei, et al.
Pubblicazione: (2025)
Robo-ABC: Affordance Generalization Beyond Categories via Semantic Correspondence for Robot Manipulation
di: Ju, Yuanchen, et al.
Pubblicazione: (2024)
di: Ju, Yuanchen, et al.
Pubblicazione: (2024)
DexGraspNet 2.0: Learning Generative Dexterous Grasping in Large-scale Synthetic Cluttered Scenes
di: Zhang, Jialiang, et al.
Pubblicazione: (2024)
di: Zhang, Jialiang, et al.
Pubblicazione: (2024)
Towards Generalizable Vision-Language Robotic Manipulation: A Benchmark and LLM-guided 3D Policy
di: Garcia, Ricardo, et al.
Pubblicazione: (2024)
di: Garcia, Ricardo, et al.
Pubblicazione: (2024)
Open-Set 3D Semantic Instance Maps for Vision Language Navigation -- O3D-SIM
di: Nanwani, Laksh, et al.
Pubblicazione: (2024)
di: Nanwani, Laksh, et al.
Pubblicazione: (2024)
Documenti analoghi
-
OSMa-Bench: Evaluating Open Semantic Mapping Under Varying Lighting Conditions
di: Popov, Maxim, et al.
Pubblicazione: (2025) -
AgentGrounder: Zero-Shot 3D Visual Pointcloud Grounding using Multimodal Language Models
di: Huynh, Cuong, et al.
Pubblicazione: (2026) -
R5DGS: Semantic-Aware 4D Gaussian Splatting with Rigid Body Constraints for Efficient Dynamic Scene Reconstruction
di: Gridusov, Denis, et al.
Pubblicazione: (2026) -
RADIO-ViPE: Online Tightly Coupled Multi-Modal Fusion for Open-Vocabulary Semantic SLAM in Dynamic Environments
di: Nasser, Zaid, et al.
Pubblicazione: (2026) -
DualMap: Online Open-Vocabulary Semantic Mapping for Natural Language Navigation in Dynamic Changing Scenes
di: Jiang, Jiajun, et al.
Pubblicazione: (2025)