SpatiaLoc: Leveraging Multi-Level Spatial Enhanced Descriptors for Cross-Modal Localization
Fuente:
arXiv
Salvato in:
| Autori principali: | Shang, Tianyi, Xu, Pengjie, Deng, Zhaojun, Li, Zhenyu, Chen, Zhicong, Wu, Lijun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Vehicle-Scene Interaction: A Text-Driven 3D Lidar Place Recognition Method for Autonomous Driving
di: Shang, Tianyi, et al.
Pubblicazione: (2025)
di: Shang, Tianyi, et al.
Pubblicazione: (2025)
Place Recognition Meet Multiple Modalitie: A Comprehensive Review, Current Challenges and Future Directions
di: Li, Zhenyu, et al.
Pubblicazione: (2025)
di: Li, Zhenyu, et al.
Pubblicazione: (2025)
MambaPlace:Text-to-Point-Cloud Cross-Modal Place Recognition with Attention Mamba Mechanisms
di: Shang, Tianyi, et al.
Pubblicazione: (2024)
di: Shang, Tianyi, et al.
Pubblicazione: (2024)
A2GC: Asymmetric Aggregation with Geometric Constraints for Locally Aggregated Descriptors
di: Li, Zhenyu, et al.
Pubblicazione: (2025)
di: Li, Zhenyu, et al.
Pubblicazione: (2025)
Bridging Text and Vision: A Multi-View Text-Vision Registration Approach for Cross-Modal Place Recognition
di: Shang, Tianyi, et al.
Pubblicazione: (2025)
di: Shang, Tianyi, et al.
Pubblicazione: (2025)
Spatia: Video Generation with Updatable Spatial Memory
di: Zhao, Jinjing, et al.
Pubblicazione: (2025)
di: Zhao, Jinjing, et al.
Pubblicazione: (2025)
OptiCorNet: Optimizing Sequence-Based Context Correlation for Visual Place Recognition
di: Li, Zhenyu, et al.
Pubblicazione: (2025)
di: Li, Zhenyu, et al.
Pubblicazione: (2025)
Adversarial Attacks on Robot Localization Systems via Deep Feature Perturbation
di: Li, Zhenyu, et al.
Pubblicazione: (2026)
di: Li, Zhenyu, et al.
Pubblicazione: (2026)
UnLoc: Leveraging Depth Uncertainties for Floorplan Localization
di: Wüest, Matthias, et al.
Pubblicazione: (2025)
di: Wüest, Matthias, et al.
Pubblicazione: (2025)
TransLocNet: Cross-Modal Attention for Aerial-Ground Vehicle Localization with Contrastive Learning
di: Pham, Phu, et al.
Pubblicazione: (2025)
di: Pham, Phu, et al.
Pubblicazione: (2025)
SceneGraphLoc: Cross-Modal Coarse Visual Localization on 3D Scene Graphs
di: Miao, Yang, et al.
Pubblicazione: (2024)
di: Miao, Yang, et al.
Pubblicazione: (2024)
Loc$^2$: Interpretable Cross-View Localization via Depth-Lifted Local Feature Matching
di: Xia, Zimin, et al.
Pubblicazione: (2025)
di: Xia, Zimin, et al.
Pubblicazione: (2025)
Riemannian and Symplectic Geometry for Hierarchical Text-Driven Place Recognition
di: Shang, Tianyi, et al.
Pubblicazione: (2026)
di: Shang, Tianyi, et al.
Pubblicazione: (2026)
Leveraging Modality Tags for Enhanced Cross-Modal Video Retrieval
di: Fragomeni, Adriano, et al.
Pubblicazione: (2025)
di: Fragomeni, Adriano, et al.
Pubblicazione: (2025)
SpatiaLQA: A Benchmark for Evaluating Spatial Logical Reasoning in Vision-Language Models
di: Xie, Yuechen, et al.
Pubblicazione: (2026)
di: Xie, Yuechen, et al.
Pubblicazione: (2026)
CurriculumLoc: Enhancing Cross-Domain Geolocalization through Multi-Stage Refinement
di: Hu, Boni, et al.
Pubblicazione: (2023)
di: Hu, Boni, et al.
Pubblicazione: (2023)
GLDesigner: Leveraging Multi-Modal LLMs as Designer for Enhanced Aesthetic Text Glyph Layouts
di: He, Junwen, et al.
Pubblicazione: (2024)
di: He, Junwen, et al.
Pubblicazione: (2024)
DiffusionUavLoc: Visually Prompted Diffusion for Cross-View UAV Localization
di: Liu, Tao, et al.
Pubblicazione: (2025)
di: Liu, Tao, et al.
Pubblicazione: (2025)
MSG-Loc: Multi-Label Likelihood-based Semantic Graph Matching for Object-Level Global Localization
di: Lee, Gihyeon, et al.
Pubblicazione: (2025)
di: Lee, Gihyeon, et al.
Pubblicazione: (2025)
MVL-Loc: Leveraging Vision-Language Model for Generalizable Multi-Scene Camera Relocalization
di: Xiao, Zhendong, et al.
Pubblicazione: (2025)
di: Xiao, Zhendong, et al.
Pubblicazione: (2025)
360Loc: A Dataset and Benchmark for Omnidirectional Visual Localization with Cross-device Queries
di: Huang, Huajian, et al.
Pubblicazione: (2023)
di: Huang, Huajian, et al.
Pubblicazione: (2023)
Leveraging Multi-Modal Information to Enhance Dataset Distillation
di: Li, Zhe, et al.
Pubblicazione: (2025)
di: Li, Zhe, et al.
Pubblicazione: (2025)
Decoupled Cross-Modal Alignment Network for Text-RGBT Person Retrieval and A High-Quality Benchmark
di: Deng, Yifei, et al.
Pubblicazione: (2025)
di: Deng, Yifei, et al.
Pubblicazione: (2025)
GSplatLoc: Grounding Keypoint Descriptors into 3D Gaussian Splatting for Improved Visual Localization
di: Sidorov, Gennady, et al.
Pubblicazione: (2024)
di: Sidorov, Gennady, et al.
Pubblicazione: (2024)
AstroLoc: Robust Space to Ground Image Localizer
di: Berton, Gabriele, et al.
Pubblicazione: (2025)
di: Berton, Gabriele, et al.
Pubblicazione: (2025)
DiaLoc: An Iterative Approach to Embodied Dialog Localization
di: Zhang, Chao, et al.
Pubblicazione: (2024)
di: Zhang, Chao, et al.
Pubblicazione: (2024)
LunarLoc: Segment-Based Global Localization on the Moon
di: Thomas, Annika, et al.
Pubblicazione: (2025)
di: Thomas, Annika, et al.
Pubblicazione: (2025)
VFM-Loc: Zero-Shot Cross-View Geo-Localization via Aligning Discriminative Visual Hierarchies
di: Lu, Jun, et al.
Pubblicazione: (2026)
di: Lu, Jun, et al.
Pubblicazione: (2026)
MultiLoc: Multi-view Guided Relative Pose Regression for Fast and Robust Visual Re-Localization
di: Dang, Nobel, et al.
Pubblicazione: (2026)
di: Dang, Nobel, et al.
Pubblicazione: (2026)
GSplatLoc: Ultra-Precise Camera Localization via 3D Gaussian Splatting
di: Zeller, Atticus J., et al.
Pubblicazione: (2024)
di: Zeller, Atticus J., et al.
Pubblicazione: (2024)
SpatiaLab: Can Vision-Language Models Perform Spatial Reasoning in the Wild?
di: Wasi, Azmine Toushik, et al.
Pubblicazione: (2026)
di: Wasi, Azmine Toushik, et al.
Pubblicazione: (2026)
UAV-VisLoc: A Large-scale Dataset for UAV Visual Localization
di: Xu, Wenjia, et al.
Pubblicazione: (2024)
di: Xu, Wenjia, et al.
Pubblicazione: (2024)
UniLoc: Towards Universal Place Recognition Using Any Single Modality
di: Xia, Yan, et al.
Pubblicazione: (2024)
di: Xia, Yan, et al.
Pubblicazione: (2024)
Game4Loc: A UAV Geo-Localization Benchmark from Game Data
di: Ji, Yuxiang, et al.
Pubblicazione: (2024)
di: Ji, Yuxiang, et al.
Pubblicazione: (2024)
Spatial-Frequency Enhanced Mamba for Multi-Modal Image Fusion
di: Sun, Hui, et al.
Pubblicazione: (2025)
di: Sun, Hui, et al.
Pubblicazione: (2025)
Semantic-Enhanced Cross-Modal Place Recognition for Robust Robot Localization
di: Lin, Yujia, et al.
Pubblicazione: (2025)
di: Lin, Yujia, et al.
Pubblicazione: (2025)
ImLoc: Revisiting Visual Localization with Image-based Representation
di: Jiang, Xudong, et al.
Pubblicazione: (2026)
di: Jiang, Xudong, et al.
Pubblicazione: (2026)
COM3D: Leveraging Cross-View Correspondence and Cross-Modal Mining for 3D Retrieval
di: Wu, Hao, et al.
Pubblicazione: (2024)
di: Wu, Hao, et al.
Pubblicazione: (2024)
Beyond Semantics: Uncovering the Physics of Fakes via Universal Physical Descriptors for Cross-Modal Synthetic Detection
di: Qiu, Mei, et al.
Pubblicazione: (2026)
di: Qiu, Mei, et al.
Pubblicazione: (2026)
CLIP-Loc: Multi-modal Landmark Association for Global Localization in Object-based Maps
di: Matsuzaki, Shigemichi, et al.
Pubblicazione: (2024)
di: Matsuzaki, Shigemichi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Vehicle-Scene Interaction: A Text-Driven 3D Lidar Place Recognition Method for Autonomous Driving
di: Shang, Tianyi, et al.
Pubblicazione: (2025) -
Place Recognition Meet Multiple Modalitie: A Comprehensive Review, Current Challenges and Future Directions
di: Li, Zhenyu, et al.
Pubblicazione: (2025) -
MambaPlace:Text-to-Point-Cloud Cross-Modal Place Recognition with Attention Mamba Mechanisms
di: Shang, Tianyi, et al.
Pubblicazione: (2024) -
A2GC: Asymmetric Aggregation with Geometric Constraints for Locally Aggregated Descriptors
di: Li, Zhenyu, et al.
Pubblicazione: (2025) -
Bridging Text and Vision: A Multi-View Text-Vision Registration Approach for Cross-Modal Place Recognition
di: Shang, Tianyi, et al.
Pubblicazione: (2025)