CLIP-Clique: Graph-based Correspondence Matching Augmented by Vision Language Models for Object-based Global Localization
Fuente:
arXiv
Salvato in:
| Autori principali: | Matsuzaki, Shigemichi, Tanaka, Kazuhito, Shintani, Kazuhiro |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CLIP-Loc: Multi-modal Landmark Association for Global Localization in Object-based Maps
di: Matsuzaki, Shigemichi, et al.
Pubblicazione: (2024)
di: Matsuzaki, Shigemichi, et al.
Pubblicazione: (2024)
MSG-Loc: Multi-Label Likelihood-based Semantic Graph Matching for Object-Level Global Localization
di: Lee, Gihyeon, et al.
Pubblicazione: (2025)
di: Lee, Gihyeon, et al.
Pubblicazione: (2025)
Self-Supervised Geometry-Guided Initialization for Robust Monocular Visual Odometry
di: Kanai, Takayuki, et al.
Pubblicazione: (2024)
di: Kanai, Takayuki, et al.
Pubblicazione: (2024)
Multimodal Active Measurement for Human Mesh Recovery in Close Proximity
di: Maeda, Takahiro, et al.
Pubblicazione: (2023)
di: Maeda, Takahiro, et al.
Pubblicazione: (2023)
SOS-Match: Segmentation for Open-Set Robust Correspondence Search and Robot Localization in Unstructured Environments
di: Thomas, Annika, et al.
Pubblicazione: (2024)
di: Thomas, Annika, et al.
Pubblicazione: (2024)
CLIPPER+: A Fast Maximal Clique Algorithm for Robust Global Registration
di: Fathian, Kaveh, et al.
Pubblicazione: (2024)
di: Fathian, Kaveh, et al.
Pubblicazione: (2024)
Proto-CLIP: Vision-Language Prototypical Network for Few-Shot Learning
di: P, Jishnu Jaykumar, et al.
Pubblicazione: (2023)
di: P, Jishnu Jaykumar, et al.
Pubblicazione: (2023)
NeuSurfEmb: A Complete Pipeline for Dense Correspondence-based 6D Object Pose Estimation without CAD Models
di: Milano, Francesco, et al.
Pubblicazione: (2024)
di: Milano, Francesco, et al.
Pubblicazione: (2024)
Global Prior Meets Local Consistency: Dual-Memory Augmented Vision-Language-Action Model for Efficient Robotic Manipulation
di: Li, Zaijing, et al.
Pubblicazione: (2026)
di: Li, Zaijing, et al.
Pubblicazione: (2026)
VLM-GLoc: Vision-Language Model Enhanced Monte Carlo Localization for Robust Semantic Global Localization in Cluttered Quasi-Static Environments
di: Agrawal, Shivendra, et al.
Pubblicazione: (2026)
di: Agrawal, Shivendra, et al.
Pubblicazione: (2026)
BOP-ASK: Object-Interaction Reasoning for Vision-Language Models
di: Bhat, Vineet, et al.
Pubblicazione: (2025)
di: Bhat, Vineet, et al.
Pubblicazione: (2025)
GOReloc: Graph-based Object-Level Relocalization for Visual SLAM
di: Wang, Yutong, et al.
Pubblicazione: (2024)
di: Wang, Yutong, et al.
Pubblicazione: (2024)
Event-based Heterogeneous Information Processing for Online Vision-based Obstacle Detection and Localization
di: Ahmadvand, Reza, et al.
Pubblicazione: (2026)
di: Ahmadvand, Reza, et al.
Pubblicazione: (2026)
Hierarchical Semantic-Augmented Navigation: Optimal Transport and Graph-Driven Reasoning for Vision-Language Navigation
di: Fang, Xiang, et al.
Pubblicazione: (2026)
di: Fang, Xiang, et al.
Pubblicazione: (2026)
Dual-Stream Diffusion for World-Model Augmented Vision-Language-Action Model
di: Won, John, et al.
Pubblicazione: (2025)
di: Won, John, et al.
Pubblicazione: (2025)
WMNav: Integrating Vision-Language Models into World Models for Object Goal Navigation
di: Nie, Dujun, et al.
Pubblicazione: (2025)
di: Nie, Dujun, et al.
Pubblicazione: (2025)
FUSELOC: Fusing Global and Local Descriptors to Disambiguate 2D-3D Matching in Visual Localization
di: Nguyen, Son Tung, et al.
Pubblicazione: (2024)
di: Nguyen, Son Tung, et al.
Pubblicazione: (2024)
VoroNav: Voronoi-based Zero-shot Object Navigation with Large Language Model
di: Wu, Pengying, et al.
Pubblicazione: (2024)
di: Wu, Pengying, et al.
Pubblicazione: (2024)
Vision-based Manipulation from Single Human Video with Open-World Object Graphs
di: Zhu, Yifeng, et al.
Pubblicazione: (2024)
di: Zhu, Yifeng, et al.
Pubblicazione: (2024)
G3Reg: Pyramid Graph-based Global Registration using Gaussian Ellipsoid Model
di: Qiao, Zhijian, et al.
Pubblicazione: (2023)
di: Qiao, Zhijian, et al.
Pubblicazione: (2023)
Three-Step Nav: A Hierarchical Global-Local Planner for Zero-Shot Vision-and-Language Navigation
di: Zheng, Wanrong, et al.
Pubblicazione: (2026)
di: Zheng, Wanrong, et al.
Pubblicazione: (2026)
DynamicVLA: A Vision-Language-Action Model for Dynamic Object Manipulation
di: Xie, Haozhe, et al.
Pubblicazione: (2026)
di: Xie, Haozhe, et al.
Pubblicazione: (2026)
BEVDiffLoc: End-to-End LiDAR Global Localization in BEV View based on Diffusion Model
di: Wang, Ziyue, et al.
Pubblicazione: (2025)
di: Wang, Ziyue, et al.
Pubblicazione: (2025)
PAVLM: Advancing Point Cloud based Affordance Understanding Via Vision-Language Model
di: Liu, Shang-Ching, et al.
Pubblicazione: (2024)
di: Liu, Shang-Ching, et al.
Pubblicazione: (2024)
Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey
di: Shao, Rui, et al.
Pubblicazione: (2025)
di: Shao, Rui, et al.
Pubblicazione: (2025)
Image-based Geo-localization for Robotics: Are Black-box Vision-Language Models there yet?
di: Waheed, Sania, et al.
Pubblicazione: (2025)
di: Waheed, Sania, et al.
Pubblicazione: (2025)
Keyframe-based Dense Mapping with the Graph of View-Dependent Local Maps
di: Zielinski, Krzysztof, et al.
Pubblicazione: (2026)
di: Zielinski, Krzysztof, et al.
Pubblicazione: (2026)
MAP-VLA: Memory-Augmented Prompting for Vision-Language-Action Model in Robotic Manipulation
di: Li, Runhao, et al.
Pubblicazione: (2025)
di: Li, Runhao, et al.
Pubblicazione: (2025)
From Words to Poses: Enhancing Novel Object Pose Estimation with Vision Language Models
di: Pulli, Tessa, et al.
Pubblicazione: (2024)
di: Pulli, Tessa, et al.
Pubblicazione: (2024)
StreamingVLA: Streaming Vision-Language-Action Model with Action Flow Matching and Adaptive Early Observation
di: Shi, Yiran, et al.
Pubblicazione: (2026)
di: Shi, Yiran, et al.
Pubblicazione: (2026)
Language-Based Augmentation to Address Shortcut Learning in Object Goal Navigation
di: Hoftijzer, Dennis, et al.
Pubblicazione: (2024)
di: Hoftijzer, Dennis, et al.
Pubblicazione: (2024)
Geometry-aided Vision-based Localization of Future Mars Helicopters in Challenging Illumination Conditions
di: Pisanti, Dario, et al.
Pubblicazione: (2025)
di: Pisanti, Dario, et al.
Pubblicazione: (2025)
RaLF: Flow-based Global and Metric Radar Localization in LiDAR Maps
di: Nayak, Abhijeet, et al.
Pubblicazione: (2023)
di: Nayak, Abhijeet, et al.
Pubblicazione: (2023)
TAG: Target-Agnostic Guidance for Stable Object-Centric Inference in Vision-Language-Action Models
di: Zhou, Jiaying, et al.
Pubblicazione: (2026)
di: Zhou, Jiaying, et al.
Pubblicazione: (2026)
MomaGraph: State-Aware Unified Scene Graphs with Vision-Language Model for Embodied Task Planning
di: Ju, Yuanchen, et al.
Pubblicazione: (2025)
di: Ju, Yuanchen, et al.
Pubblicazione: (2025)
GeoVLM: Improving Automated Vehicle Geolocalisation Using Vision-Language Matching
di: Dagda, Barkin, et al.
Pubblicazione: (2025)
di: Dagda, Barkin, et al.
Pubblicazione: (2025)
From Local Matches to Global Masks: Template-Guided Instance Detection and Segmentation in Open-World Scenes
di: Zhang, Qifan, et al.
Pubblicazione: (2026)
di: Zhang, Qifan, et al.
Pubblicazione: (2026)
FADet: A Multi-sensor 3D Object Detection Network based on Local Featured Attention
di: Guo, Ziang, et al.
Pubblicazione: (2024)
di: Guo, Ziang, et al.
Pubblicazione: (2024)
R4: Retrieval-Augmented Reasoning for Vision-Language Models in 4D Spatio-Temporal Space
di: Sohn, Tin Stribor, et al.
Pubblicazione: (2025)
di: Sohn, Tin Stribor, et al.
Pubblicazione: (2025)
DOPE: Dual Object Perception-Enhancement Network for Vision-and-Language Navigation
di: Yu, Yinfeng, et al.
Pubblicazione: (2025)
di: Yu, Yinfeng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
CLIP-Loc: Multi-modal Landmark Association for Global Localization in Object-based Maps
di: Matsuzaki, Shigemichi, et al.
Pubblicazione: (2024) -
MSG-Loc: Multi-Label Likelihood-based Semantic Graph Matching for Object-Level Global Localization
di: Lee, Gihyeon, et al.
Pubblicazione: (2025) -
Self-Supervised Geometry-Guided Initialization for Robust Monocular Visual Odometry
di: Kanai, Takayuki, et al.
Pubblicazione: (2024) -
Multimodal Active Measurement for Human Mesh Recovery in Close Proximity
di: Maeda, Takahiro, et al.
Pubblicazione: (2023) -
SOS-Match: Segmentation for Open-Set Robust Correspondence Search and Robot Localization in Unstructured Environments
di: Thomas, Annika, et al.
Pubblicazione: (2024)