Hierarchical Matching and Reasoning for Multi-Query Image Retrieval
Fuente:
arXiv
Saved in:
| Main Authors: | Ji, Zhong, Li, Zhihao, Zhang, Yan, Wang, Haoran, Pang, Yanwei, Li, Xuelong |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
iEBAKER: Improved Remote Sensing Image-Text Retrieval Framework via Eliminate Before Align and Keyword Explicit Reasoning
by: Zhang, Yan, et al.
Published: (2025)
by: Zhang, Yan, et al.
Published: (2025)
Underlying Semantic Diffusion for Effective and Efficient In-Context Learning
by: Ji, Zhong, et al.
Published: (2025)
by: Ji, Zhong, et al.
Published: (2025)
Optimal Transport Adapter Tuning for Bridging Modality Gaps in Few-Shot Remote Sensing Scene Classification
by: Ji, Zhong, et al.
Published: (2025)
by: Ji, Zhong, et al.
Published: (2025)
Deep Intra-Image Contrastive Learning for Weakly Supervised One-Step Person Search
by: Wang, Jiabei, et al.
Published: (2023)
by: Wang, Jiabei, et al.
Published: (2023)
VFMM3D: Releasing the Potential of Image by Vision Foundation Model for Monocular 3D Object Detection
by: Ding, Bonan, et al.
Published: (2024)
by: Ding, Bonan, et al.
Published: (2024)
Dual Contrastive Network for Few-Shot Remote Sensing Image Scene Classification
by: Ji, Zhong, et al.
Published: (2026)
by: Ji, Zhong, et al.
Published: (2026)
Transformer-based stereo-aware 3D object detection from binocular images
by: Sun, Hanqing, et al.
Published: (2023)
by: Sun, Hanqing, et al.
Published: (2023)
Interpretable Few-Shot Image Classification via Prototypical Concept-Guided Mixture of LoRA Experts
by: Ji, Zhong, et al.
Published: (2025)
by: Ji, Zhong, et al.
Published: (2025)
ViewMask-1-to-3: Multi-View Consistent Image Generation via Multimodal Diffusion Models
by: Zhu, Ruishu, et al.
Published: (2025)
by: Zhu, Ruishu, et al.
Published: (2025)
Improving the Reasoning of Multi-Image Grounding in MLLMs via Reinforcement Learning
by: Zhang, Bob, et al.
Published: (2025)
by: Zhang, Bob, et al.
Published: (2025)
Multi-Stage Knowledge Integration of Vision-Language Models for Continual Learning
by: Zhang, Hongsheng, et al.
Published: (2024)
by: Zhang, Hongsheng, et al.
Published: (2024)
Decoupling the Image Perception and Multimodal Reasoning for Reasoning Segmentation with Digital Twin Representations
by: Li, Yizhen, et al.
Published: (2025)
by: Li, Yizhen, et al.
Published: (2025)
Sub-Image Recapture for Multi-View 3D Reconstruction
by: Wang, Yanwei
Published: (2025)
by: Wang, Yanwei
Published: (2025)
Prototype Correlation Matching and Class-Relation Reasoning for Few-Shot Medical Image Segmentation
by: Zhang, Yumin, et al.
Published: (2024)
by: Zhang, Yumin, et al.
Published: (2024)
FarmMind: Reasoning-Query-Driven Dynamic Segmentation for Farmland Remote Sensing Images
by: Wu, Haiyang, et al.
Published: (2026)
by: Wu, Haiyang, et al.
Published: (2026)
NWPU-MOC: A Benchmark for Fine-grained Multi-category Object Counting in Aerial Images
by: Gao, Junyu, et al.
Published: (2024)
by: Gao, Junyu, et al.
Published: (2024)
CODER: Coupled Diversity-Sensitive Momentum Contrastive Learning for Image-Text Retrieval
by: Wang, Haoran, et al.
Published: (2022)
by: Wang, Haoran, et al.
Published: (2022)
PanopticQuery: Unified Query-Time Reasoning for 4D Scenes
by: Tang, Ruilin, et al.
Published: (2026)
by: Tang, Ruilin, et al.
Published: (2026)
Flexible 3D Lane Detection by Hierarchical Shape MatchingFlexible 3D Lane Detection by Hierarchical Shape Matching
by: Guan, Zhihao, et al.
Published: (2024)
by: Guan, Zhihao, et al.
Published: (2024)
Zooming from Context to Cue: Hierarchical Preference Optimization for Multi-Image MLLMs
by: Li, Xudong, et al.
Published: (2025)
by: Li, Xudong, et al.
Published: (2025)
Raformer: Redundancy-Aware Transformer for Video Wire Inpainting
by: Ji, Zhong, et al.
Published: (2024)
by: Ji, Zhong, et al.
Published: (2024)
CLIPer: Hierarchically Improving Spatial Representation of CLIP for Open-Vocabulary Semantic Segmentation
by: Sun, Lin, et al.
Published: (2024)
by: Sun, Lin, et al.
Published: (2024)
FedHPro: Federated Hyper-Prototype Learning via Gradient Matching
by: Wang, Huan, et al.
Published: (2026)
by: Wang, Huan, et al.
Published: (2026)
Learning Attribute-Aware Hash Codes for Fine-Grained Image Retrieval via Query Optimization
by: Wang, Peng, et al.
Published: (2025)
by: Wang, Peng, et al.
Published: (2025)
QwenStyle: Content-Preserving Style Transfer with Qwen-Image-Edit
by: Zhang, Shiwen, et al.
Published: (2026)
by: Zhang, Shiwen, et al.
Published: (2026)
Hyperbolic Hierarchical Alignment Reasoning Network for Text-3D Retrieval
by: Li, Wenrui, et al.
Published: (2025)
by: Li, Wenrui, et al.
Published: (2025)
ReasonGrounder: LVLM-Guided Hierarchical Feature Splatting for Open-Vocabulary 3D Visual Grounding and Reasoning
by: Liu, Zhenyang, et al.
Published: (2025)
by: Liu, Zhenyang, et al.
Published: (2025)
Towards Efficient Deep Hashing Retrieval: Condensing Your Data via Feature-Embedding Matching
by: Feng, Tao, et al.
Published: (2023)
by: Feng, Tao, et al.
Published: (2023)
COLI: A Hierarchical Efficient Compressor for Large Images
by: Wang, Haoran, et al.
Published: (2025)
by: Wang, Haoran, et al.
Published: (2025)
MERIT: Multilingual Semantic Retrieval with Interleaved Multi-Condition Query
by: Chow, Wei, et al.
Published: (2025)
by: Chow, Wei, et al.
Published: (2025)
PinPoint: Evaluation of Composed Image Retrieval with Explicit Negatives, Multi-Image Queries, and Paraphrase Testing
by: Mahadev, Rohan, et al.
Published: (2026)
by: Mahadev, Rohan, et al.
Published: (2026)
Frequency Domain Nuances Mining for Visible-Infrared Person Re-identification
by: Zhang, Yukang, et al.
Published: (2024)
by: Zhang, Yukang, et al.
Published: (2024)
Semi-LLIE: Semi-supervised Contrastive Learning with Mamba-based Low-light Image Enhancement
by: Li, Guanlin, et al.
Published: (2024)
by: Li, Guanlin, et al.
Published: (2024)
A Fresh Look at Generalized Category Discovery through Non-negative Matrix Factorization
by: Ji, Zhong, et al.
Published: (2024)
by: Ji, Zhong, et al.
Published: (2024)
Multi-Granularity Reasoning for Image Quality Assessment via Attribute-Aware Reinforcement Learning to Rank
by: Chen, Xiangyong, et al.
Published: (2026)
by: Chen, Xiangyong, et al.
Published: (2026)
HINT: Hierarchical Interaction Modeling for Autoregressive Multi-Human Motion Generation
by: Liu, Mengge, et al.
Published: (2026)
by: Liu, Mengge, et al.
Published: (2026)
DVIS-DAQ: Improving Video Segmentation via Dynamic Anchor Queries
by: Zhou, Yikang, et al.
Published: (2024)
by: Zhou, Yikang, et al.
Published: (2024)
Matching Query Image Against Selected NeRF Feature for Efficient and Scalable Localization
by: Zhou, Huaiji, et al.
Published: (2024)
by: Zhou, Huaiji, et al.
Published: (2024)
Visual-RAG: Benchmarking Text-to-Image Retrieval Augmented Generation for Visual Knowledge Intensive Queries
by: Wu, Yin, et al.
Published: (2025)
by: Wu, Yin, et al.
Published: (2025)
DeliCIR: Deliberative Test-Time Evolutionary Hierarchical Multi-Agents for Composed Image Retrieval
by: Pei, Xingtian, et al.
Published: (2026)
by: Pei, Xingtian, et al.
Published: (2026)
Similar Items
-
iEBAKER: Improved Remote Sensing Image-Text Retrieval Framework via Eliminate Before Align and Keyword Explicit Reasoning
by: Zhang, Yan, et al.
Published: (2025) -
Underlying Semantic Diffusion for Effective and Efficient In-Context Learning
by: Ji, Zhong, et al.
Published: (2025) -
Optimal Transport Adapter Tuning for Bridging Modality Gaps in Few-Shot Remote Sensing Scene Classification
by: Ji, Zhong, et al.
Published: (2025) -
Deep Intra-Image Contrastive Learning for Weakly Supervised One-Step Person Search
by: Wang, Jiabei, et al.
Published: (2023) -
VFMM3D: Releasing the Potential of Image by Vision Foundation Model for Monocular 3D Object Detection
by: Ding, Bonan, et al.
Published: (2024)