Towards Interpretable Geo-localization: a Concept-Aware Global Image-GPS Alignment Framework
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jia, Furong, Liu, Lanxin, Hou, Ce, Zhang, Fan, Liu, Xinyan, Liu, Yu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AIFIND: Artifact-Aware Interpreting Fine-Grained Alignment for Incremental Face Forgery Detection
par: Wang, Hao, et autres
Publié: (2026)
par: Wang, Hao, et autres
Publié: (2026)
Concept Complement Bottleneck Model for Interpretable Medical Image Diagnosis
par: Wang, Hongmei, et autres
Publié: (2024)
par: Wang, Hongmei, et autres
Publié: (2024)
SyCoCa: Symmetrizing Contrastive Captioners with Attentive Masking for Multimodal Alignment
par: Ma, Ziping, et autres
Publié: (2024)
par: Ma, Ziping, et autres
Publié: (2024)
Uncertainty-Aware Concept Bottleneck Models with Enhanced Interpretability
par: Zhang, Haifei, et autres
Publié: (2025)
par: Zhang, Haifei, et autres
Publié: (2025)
FunOTTA: On-the-Fly Adaptation on Cross-Domain Fundus Image via Stable Test-time Training
par: Zeng, Qian, et autres
Publié: (2024)
par: Zeng, Qian, et autres
Publié: (2024)
CTFS : Collaborative Teacher Framework for Forward-Looking Sonar Image Semantic Segmentation with Extremely Limited Labels
par: Guo, Ping, et autres
Publié: (2026)
par: Guo, Ping, et autres
Publié: (2026)
MICA: Towards Explainable Skin Lesion Diagnosis via Multi-Level Image-Concept Alignment
par: Bie, Yequan, et autres
Publié: (2024)
par: Bie, Yequan, et autres
Publié: (2024)
TRCE: Towards Reliable Malicious Concept Erasure in Text-to-Image Diffusion Models
par: Chen, Ruidong, et autres
Publié: (2025)
par: Chen, Ruidong, et autres
Publié: (2025)
TowerDataset: A Heterogeneous Benchmark for Transmission Corridor Segmentation with a Global-Local Fusion Framework
par: Cui, Xu, et autres
Publié: (2026)
par: Cui, Xu, et autres
Publié: (2026)
Geometry-Aware Cross Modal Alignment for Light Field-LiDAR Semantic Segmentation
par: Luo, Jie, et autres
Publié: (2025)
par: Luo, Jie, et autres
Publié: (2025)
Unsupervised Synthetic Image Attribution: Alignment and Disentanglement
par: Liu, Zongfang, et autres
Publié: (2026)
par: Liu, Zongfang, et autres
Publié: (2026)
Replace in Translation: Boost Concept Alignment in Counterfactual Text-to-Image
par: Li, Sifan, et autres
Publié: (2025)
par: Li, Sifan, et autres
Publié: (2025)
MoCA-Video: Motion-Aware Concept Alignment for Consistent Video Editing
par: Zhang, Tong, et autres
Publié: (2025)
par: Zhang, Tong, et autres
Publié: (2025)
PSA-VLM: Enhancing Vision-Language Model Safety through Progressive Concept-Bottleneck-Driven Alignment
par: Liu, Zhendong, et autres
Publié: (2024)
par: Liu, Zhendong, et autres
Publié: (2024)
Gradual Residuals Alignment: A Dual-Stream Framework for GAN Inversion and Image Attribute Editing
par: Li, Hao, et autres
Publié: (2024)
par: Li, Hao, et autres
Publié: (2024)
RSOD: Reliability-Guided Sonar Image Object Detection with Extremely Limited Labels
par: Li, Chengzhou, et autres
Publié: (2026)
par: Li, Chengzhou, et autres
Publié: (2026)
CtrlNeRF: The Generative Neural Radiation Fields for the Controllable Synthesis of High-fidelity 3D-Aware Images
par: Liu, Jian, et autres
Publié: (2024)
par: Liu, Jian, et autres
Publié: (2024)
Towards Clinically Interpretable Ophthalmic VQA via Spatially-Grounded Lesion Evidence
par: Wang, Xingyue, et autres
Publié: (2026)
par: Wang, Xingyue, et autres
Publié: (2026)
Hierarchical Deep Fusion Framework for Multi-dimensional Facial Forgery Detection -- The 2024 Global Deepfake Image Detection Challenge
par: Wang, Kohou, et autres
Publié: (2025)
par: Wang, Kohou, et autres
Publié: (2025)
AlignVAR: Towards Globally Consistent Visual Autoregression for Image Super-Resolution
par: Liu, Cencen, et autres
Publié: (2026)
par: Liu, Cencen, et autres
Publié: (2026)
Uni-X: Mitigating Modality Conflict with a Two-End-Separated Architecture for Unified Multimodal Models
par: Hao, Jitai, et autres
Publié: (2025)
par: Hao, Jitai, et autres
Publié: (2025)
FAPE-IR: Frequency-Aware Planning and Execution Framework for All-in-One Image Restoration
par: Liu, Jingren, et autres
Publié: (2025)
par: Liu, Jingren, et autres
Publié: (2025)
Erasing Thousands of Concepts: Towards Scalable and Practical Concept Erasure for Text-to-Image Diffusion Models
par: Seo, Hoigi, et autres
Publié: (2026)
par: Seo, Hoigi, et autres
Publié: (2026)
Interpretable and Sparse Linear Attention with Decoupled Membership-Subspace Modeling via MCR2 Objective
par: Liu, Tianyuan, et autres
Publié: (2026)
par: Liu, Tianyuan, et autres
Publié: (2026)
TeleBoost: A Systematic Alignment Framework for High-Fidelity, Controllable, and Robust Video Generation
par: Liang, Yuanzhi, et autres
Publié: (2026)
par: Liang, Yuanzhi, et autres
Publié: (2026)
Context-Aware Weakly Supervised Image Manipulation Localization with SAM Refinement
par: Wang, Xinghao, et autres
Publié: (2025)
par: Wang, Xinghao, et autres
Publié: (2025)
Condition-Aware Neural Network for Controlled Image Generation
par: Cai, Han, et autres
Publié: (2024)
par: Cai, Han, et autres
Publié: (2024)
UniFusion: A Unified Image Fusion Framework with Robust Representation and Source-Aware Preservation
par: Li, Xingyuan, et autres
Publié: (2026)
par: Li, Xingyuan, et autres
Publié: (2026)
Dual-Domain Representation Alignment: Bridging 2D and 3D Vision via Geometry-Aware Architecture Search
par: Zhang, Haoyu, et autres
Publié: (2026)
par: Zhang, Haoyu, et autres
Publié: (2026)
Image-Guided Outdoor LiDAR Perception Quality Assessment for Autonomous Driving
par: Zhang, Ce, et autres
Publié: (2024)
par: Zhang, Ce, et autres
Publié: (2024)
Towards Practical Alzheimer's Disease Diagnosis: A Lightweight and Interpretable Spiking Neural Model
par: Wu, Changwei, et autres
Publié: (2025)
par: Wu, Changwei, et autres
Publié: (2025)
OmniPrism: Learning Disentangled Visual Concept for Image Generation
par: Li, Yangyang, et autres
Publié: (2024)
par: Li, Yangyang, et autres
Publié: (2024)
CP-DETR: Concept Prompt Guide DETR Toward Stronger Universal Object Detection
par: Chen, Qibo, et autres
Publié: (2024)
par: Chen, Qibo, et autres
Publié: (2024)
Empowering Backbone Models for Visual Text Generation with Input Granularity Control and Glyph-Aware Training
par: Li, Wenbo, et autres
Publié: (2024)
par: Li, Wenbo, et autres
Publié: (2024)
TDATR: Improving End-to-End Table Recognition via Table Detail-Aware Learning and Cell-Level Visual Alignment
par: Qin, Chunxia, et autres
Publié: (2026)
par: Qin, Chunxia, et autres
Publié: (2026)
Latent Bias Alignment for High-Fidelity Diffusion Inversion in Real-World Image Reconstruction and Manipulation
par: Chen, Weiming, et autres
Publié: (2026)
par: Chen, Weiming, et autres
Publié: (2026)
GAFR-Net: A Graph Attention and Fuzzy-Rule Network for Interpretable Breast Cancer Image Classification
par: Gao, Lin-Guo, et autres
Publié: (2026)
par: Gao, Lin-Guo, et autres
Publié: (2026)
Locatability-Guided Adaptive Reasoning for Image Geo-Localization with Vision-Language Models
par: Yu, Bo, et autres
Publié: (2026)
par: Yu, Bo, et autres
Publié: (2026)
MicroscopyMatching: Towards a Ready-to-use Framework for Microscopy Image Analysis in Diverse Conditions
par: Hui, Xiaofei, et autres
Publié: (2026)
par: Hui, Xiaofei, et autres
Publié: (2026)
MCA-RG: Enhancing LLMs with Medical Concept Alignment for Radiology Report Generation
par: Xing, Qilong, et autres
Publié: (2025)
par: Xing, Qilong, et autres
Publié: (2025)
Documents similaires
-
AIFIND: Artifact-Aware Interpreting Fine-Grained Alignment for Incremental Face Forgery Detection
par: Wang, Hao, et autres
Publié: (2026) -
Concept Complement Bottleneck Model for Interpretable Medical Image Diagnosis
par: Wang, Hongmei, et autres
Publié: (2024) -
SyCoCa: Symmetrizing Contrastive Captioners with Attentive Masking for Multimodal Alignment
par: Ma, Ziping, et autres
Publié: (2024) -
Uncertainty-Aware Concept Bottleneck Models with Enhanced Interpretability
par: Zhang, Haifei, et autres
Publié: (2025) -
FunOTTA: On-the-Fly Adaptation on Cross-Domain Fundus Image via Stable Test-time Training
par: Zeng, Qian, et autres
Publié: (2024)