From Local Matches to Global Masks: Template-Guided Instance Detection and Segmentation in Open-World Scenes
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Qifan, Allu, Sai Haneesh, Wang, Jikai, Lu, Yangxiao, Xiang, Yu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SCENEREPLICA: Benchmarking Real-World Robot Manipulation by Creating Replicable Scenes
por: Khargonkar, Ninad, et al.
Publicado: (2023)
por: Khargonkar, Ninad, et al.
Publicado: (2023)
A Modular Robotic System for Autonomous Exploration and Semantic Updating in Large-Scale Indoor Environments
por: Allu, Sai Haneesh, et al.
Publicado: (2024)
por: Allu, Sai Haneesh, et al.
Publicado: (2024)
Adapting Pre-Trained Vision Models for Novel Instance Detection and Segmentation
por: Lu, Yangxiao, et al.
Publicado: (2024)
por: Lu, Yangxiao, et al.
Publicado: (2024)
Grasping Trajectory Optimization with Point Clouds
por: Xiang, Yu, et al.
Publicado: (2024)
por: Xiang, Yu, et al.
Publicado: (2024)
RISeg: Robot Interactive Object Segmentation via Body Frame-Invariant Features
por: Qian, Howard H., et al.
Publicado: (2024)
por: Qian, Howard H., et al.
Publicado: (2024)
OW-Rep: Open World Object Detection with Instance Representation Learning
por: Lee, Sunoh, et al.
Publicado: (2024)
por: Lee, Sunoh, et al.
Publicado: (2024)
PanopticRecon: Leverage Open-vocabulary Instance Segmentation for Zero-shot Panoptic Reconstruction
por: Yu, Xuan, et al.
Publicado: (2024)
por: Yu, Xuan, et al.
Publicado: (2024)
Open-World Panoptic Segmentation
por: Sodano, Matteo, et al.
Publicado: (2024)
por: Sodano, Matteo, et al.
Publicado: (2024)
Leveraging Vision-Language Models for Open-Vocabulary Instance Segmentation and Tracking
por: Pätzold, Bastian, et al.
Publicado: (2025)
por: Pätzold, Bastian, et al.
Publicado: (2025)
SOS-Match: Segmentation for Open-Set Robust Correspondence Search and Robot Localization in Unstructured Environments
por: Thomas, Annika, et al.
Publicado: (2024)
por: Thomas, Annika, et al.
Publicado: (2024)
From Seedling to Harvest: The GrowingSoy Dataset for Weed Detection in Soy Crops via Instance Segmentation
por: Steinmetz, Raul, et al.
Publicado: (2024)
por: Steinmetz, Raul, et al.
Publicado: (2024)
OpenSGA: Efficient 3D Scene Graph Alignment in the Open World
por: Chen, Gang, et al.
Publicado: (2026)
por: Chen, Gang, et al.
Publicado: (2026)
SNOW: Spatio-Temporal Scene Understanding with World Knowledge for Open-World Embodied Reasoning
por: Sohn, Tin Stribor, et al.
Publicado: (2025)
por: Sohn, Tin Stribor, et al.
Publicado: (2025)
SemanticFlow: A Self-Supervised Framework for Joint Scene Flow Prediction and Instance Segmentation in Dynamic Environments
por: Chen, Yinqi, et al.
Publicado: (2025)
por: Chen, Yinqi, et al.
Publicado: (2025)
SpaCeFormer: Fast Proposal-Free Open-Vocabulary 3D Instance Segmentation
por: Choy, Chris, et al.
Publicado: (2026)
por: Choy, Chris, et al.
Publicado: (2026)
Improved Scene Landmark Detection for Camera Localization
por: Do, Tien, et al.
Publicado: (2024)
por: Do, Tien, et al.
Publicado: (2024)
Clutt3R-Seg: Sparse-view 3D Instance Segmentation for Language-grounded Grasping in Cluttered Scenes
por: Noh, Jeongho, et al.
Publicado: (2026)
por: Noh, Jeongho, et al.
Publicado: (2026)
Adapting Segment Anything Model for Unseen Object Instance Segmentation
por: Cao, Rui, et al.
Publicado: (2024)
por: Cao, Rui, et al.
Publicado: (2024)
BEV-SLD: Self-Supervised Scene Landmark Detection for Global Localization with LiDAR Bird's-Eye View Images
por: Skuddis, David, et al.
Publicado: (2026)
por: Skuddis, David, et al.
Publicado: (2026)
Hierarchical Image Matching for UAV Absolute Visual Localization via Semantic and Structural Constraints
por: Zhang, Xiangkai, et al.
Publicado: (2025)
por: Zhang, Xiangkai, et al.
Publicado: (2025)
UnIRe: Unsupervised Instance Decomposition for Dynamic Urban Scene Reconstruction
por: Mao, Yunxuan, et al.
Publicado: (2025)
por: Mao, Yunxuan, et al.
Publicado: (2025)
FUSELOC: Fusing Global and Local Descriptors to Disambiguate 2D-3D Matching in Visual Localization
por: Nguyen, Son Tung, et al.
Publicado: (2024)
por: Nguyen, Son Tung, et al.
Publicado: (2024)
HRT1: One-Shot Human-to-Robot Trajectory Transfer for Mobile Manipulation
por: Allu, Sai Haneesh, et al.
Publicado: (2025)
por: Allu, Sai Haneesh, et al.
Publicado: (2025)
Map-World: Masked Action planning and Path-Integral World Model for Autonomous Driving
por: Hu, Bin, et al.
Publicado: (2025)
por: Hu, Bin, et al.
Publicado: (2025)
Monocular Semantic Scene Completion via Masked Recurrent Networks
por: Wang, Xuzhi, et al.
Publicado: (2025)
por: Wang, Xuzhi, et al.
Publicado: (2025)
Towards Open-World Human Action Segmentation Using Graph Convolutional Networks
por: Xing, Hao, et al.
Publicado: (2025)
por: Xing, Hao, et al.
Publicado: (2025)
GV-Bench: Benchmarking Local Feature Matching for Geometric Verification of Long-term Loop Closure Detection
por: Yu, Jingwen, et al.
Publicado: (2024)
por: Yu, Jingwen, et al.
Publicado: (2024)
Articulated 3D Scene Graphs for Open-World Mobile Manipulation
por: Büchner, Martin, et al.
Publicado: (2026)
por: Büchner, Martin, et al.
Publicado: (2026)
SteelDS: A High-Resolution Video Dataset of E40 Steel Scrap for Object Detection and Instance Segmentation
por: Neubauer, Melanie, et al.
Publicado: (2026)
por: Neubauer, Melanie, et al.
Publicado: (2026)
Co-Win: Joint Object Detection and Instance Segmentation in LiDAR Point Clouds via Collaborative Window Processing
por: Li, Haichuan, et al.
Publicado: (2025)
por: Li, Haichuan, et al.
Publicado: (2025)
3D-AffordanceLLM: Harnessing Large Language Models for Open-Vocabulary Affordance Detection in 3D Worlds
por: Chu, Hengshuo, et al.
Publicado: (2025)
por: Chu, Hengshuo, et al.
Publicado: (2025)
VISTA: Monocular Segmentation-Based Mapping for Appearance and View-Invariant Global Localization
por: Shafferman, Hannah, et al.
Publicado: (2025)
por: Shafferman, Hannah, et al.
Publicado: (2025)
Low Latency Instance Segmentation by Continuous Clustering for LiDAR Sensors
por: Reich, Andreas, et al.
Publicado: (2023)
por: Reich, Andreas, et al.
Publicado: (2023)
OpenESS: Event-based Semantic Scene Understanding with Open Vocabularies
por: Kong, Lingdong, et al.
Publicado: (2024)
por: Kong, Lingdong, et al.
Publicado: (2024)
MSG-Loc: Multi-Label Likelihood-based Semantic Graph Matching for Object-Level Global Localization
por: Lee, Gihyeon, et al.
Publicado: (2025)
por: Lee, Gihyeon, et al.
Publicado: (2025)
Object Segmentation from Open-Vocabulary Manipulation Instructions Based on Optimal Transport Polygon Matching with Multimodal Foundation Models
por: Nishimura, Takayuki, et al.
Publicado: (2024)
por: Nishimura, Takayuki, et al.
Publicado: (2024)
InterKey: Cross-modal Intersection Keypoints for Global Localization on OpenStreetMap
por: Tran, Nguyen Hoang Khoi, et al.
Publicado: (2025)
por: Tran, Nguyen Hoang Khoi, et al.
Publicado: (2025)
From Scene to Object: Text-Guided Dual-Gaze Prediction
por: Ke, Zehong, et al.
Publicado: (2026)
por: Ke, Zehong, et al.
Publicado: (2026)
SceneGraphGrounder: Zero-Shot 3D Visual Grounding via Structured Scene Graph Matching
por: Sun, Xuefei, et al.
Publicado: (2026)
por: Sun, Xuefei, et al.
Publicado: (2026)
ODYSSEY: Open-World Quadrupeds Exploration and Manipulation for Long-Horizon Tasks
por: Wang, Kaijun, et al.
Publicado: (2025)
por: Wang, Kaijun, et al.
Publicado: (2025)
Ejemplares similares
-
SCENEREPLICA: Benchmarking Real-World Robot Manipulation by Creating Replicable Scenes
por: Khargonkar, Ninad, et al.
Publicado: (2023) -
A Modular Robotic System for Autonomous Exploration and Semantic Updating in Large-Scale Indoor Environments
por: Allu, Sai Haneesh, et al.
Publicado: (2024) -
Adapting Pre-Trained Vision Models for Novel Instance Detection and Segmentation
por: Lu, Yangxiao, et al.
Publicado: (2024) -
Grasping Trajectory Optimization with Point Clouds
por: Xiang, Yu, et al.
Publicado: (2024) -
RISeg: Robot Interactive Object Segmentation via Body Frame-Invariant Features
por: Qian, Howard H., et al.
Publicado: (2024)