PHPQ: Pyramid Hybrid Pooling Quantization for Efficient Fine-Grained Image Retrieval
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zeng, Ziyun, Wang, Jinpeng, Chen, Bin, Dai, Tao, Xia, Shu-Tao, Wang, Zhi |
|---|---|
| Format: | Preprint |
| Publié: |
2021
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GMMFormer: Gaussian-Mixture-Model Based Transformer for Efficient Partially Relevant Video Retrieval
par: Wang, Yuting, et autres
Publié: (2023)
par: Wang, Yuting, et autres
Publié: (2023)
Weakly Supervised Deep Hyperspherical Quantization for Image Retrieval
par: Wang, Jinpeng, et autres
Publié: (2024)
par: Wang, Jinpeng, et autres
Publié: (2024)
Imagine Before Concentration: Diffusion-Guided Registers Enhance Partially Relevant Video Retrieval
par: Li, Jun, et autres
Publié: (2026)
par: Li, Jun, et autres
Publié: (2026)
AutoSSVH: Exploring Automated Frame Sampling for Efficient Self-Supervised Video Hashing
par: Lian, Niu, et autres
Publié: (2025)
par: Lian, Niu, et autres
Publié: (2025)
HLFormer: Enhancing Partially Relevant Video Retrieval with Hyperbolic Learning
par: Li, Jun, et autres
Publié: (2025)
par: Li, Jun, et autres
Publié: (2025)
Efficient Self-Supervised Video Hashing with Selective State Spaces
par: Wang, Jinpeng, et autres
Publié: (2024)
par: Wang, Jinpeng, et autres
Publié: (2024)
From Verbatim to Gist: Distilling Pyramidal Multimodal Memory via Semantic Information Bottleneck for Long-Horizon Video Agents
par: Lian, Niu, et autres
Publié: (2026)
par: Lian, Niu, et autres
Publié: (2026)
Love Me, Love My Label: Rethinking the Role of Labels in Prompt Retrieval for Visual In-Context Learning
par: Luo, Tianci, et autres
Publié: (2026)
par: Luo, Tianci, et autres
Publié: (2026)
Revisiting Uncertainty: On Evidential Learning for Partially Relevant Video Retrieval
par: Li, Jun, et autres
Publié: (2026)
par: Li, Jun, et autres
Publié: (2026)
MLLM-Guided VLM Fine-Tuning with Joint Inference for Zero-Shot Composed Image Retrieval
par: Tu, Rong-Cheng, et autres
Publié: (2025)
par: Tu, Rong-Cheng, et autres
Publié: (2025)
EvdCLIP: Improving Vision-Language Retrieval with Entity Visual Descriptions from Large Language Models
par: Meng, GuangHao, et autres
Publié: (2025)
par: Meng, GuangHao, et autres
Publié: (2025)
Beyond Global Similarity: Towards Fine-Grained, Multi-Condition Multimodal Retrieval
par: Lu, Xuan, et autres
Publié: (2026)
par: Lu, Xuan, et autres
Publié: (2026)
Rethinking Composed Image Retrieval Evaluation: A Fine-Grained Benchmark from Image Editing
par: Song, Tingyu, et autres
Publié: (2026)
par: Song, Tingyu, et autres
Publié: (2026)
TIGER-FG: Text-Guided Implicit Fine-Grained Grounding for E-commerce Retrieval
par: Sun, Xinyu, et autres
Publié: (2026)
par: Sun, Xinyu, et autres
Publié: (2026)
Attributes Grouping and Mining Hashing for Fine-Grained Image Retrieval
par: Lu, Xin, et autres
Publié: (2023)
par: Lu, Xin, et autres
Publié: (2023)
Representation Discrepancy Bridging Method for Remote Sensing Image-Text Retrieval
par: Ning, Hailong, et autres
Publié: (2025)
par: Ning, Hailong, et autres
Publié: (2025)
Multimodal Reasoning Agent for Zero-Shot Composed Image Retrieval
par: Tu, Rong-Cheng, et autres
Publié: (2025)
par: Tu, Rong-Cheng, et autres
Publié: (2025)
Dual Prompt Learning for Adapting Vision-Language Models to Downstream Image-Text Retrieval
par: Wang, Yifan, et autres
Publié: (2025)
par: Wang, Yifan, et autres
Publié: (2025)
Hire: Hybrid-modal Interaction with Multiple Relational Enhancements for Image-Text Matching
par: Ge, Xuri, et autres
Publié: (2024)
par: Ge, Xuri, et autres
Publié: (2024)
CaReBench: A Fine-Grained Benchmark for Video Captioning and Retrieval
par: Xu, Yifan, et autres
Publié: (2024)
par: Xu, Yifan, et autres
Publié: (2024)
ReinPool: Reinforcement Learning Pooling Multi-Vector Embeddings for Retrieval System
par: Cha, Sungguk, et autres
Publié: (2026)
par: Cha, Sungguk, et autres
Publié: (2026)
DeepImageSearch: Benchmarking Multimodal Agents for Context-Aware Image Retrieval in Visual Histories
par: Deng, Chenlong, et autres
Publié: (2026)
par: Deng, Chenlong, et autres
Publié: (2026)
Hierarchical Patch Compression for ColPali: Efficient Multi-Vector Document Retrieval with Dynamic Pruning and Quantization
par: Bach, Duong
Publié: (2025)
par: Bach, Duong
Publié: (2025)
FF-PNet: A Pyramid Network Based on Feature and Field for Brain Image Registration
par: Zhang, Ying, et autres
Publié: (2025)
par: Zhang, Ying, et autres
Publié: (2025)
ITSELF: Attention Guided Fine-Grained Alignment for Vision-Language Retrieval
par: Nguyen, Tien-Huy, et autres
Publié: (2026)
par: Nguyen, Tien-Huy, et autres
Publié: (2026)
Fine-grained Motion Retrieval via Joint-Angle Motion Images and Token-Patch Late Interaction
par: Zhang, Yao, et autres
Publié: (2026)
par: Zhang, Yao, et autres
Publié: (2026)
Language-only Efficient Training of Zero-shot Composed Image Retrieval
par: Gu, Geonmo, et autres
Publié: (2023)
par: Gu, Geonmo, et autres
Publié: (2023)
A Resource-Efficient Training Framework for Remote Sensing Text--Image Retrieval
par: Zhang, Weihang, et autres
Publié: (2025)
par: Zhang, Weihang, et autres
Publié: (2025)
RAGAR: Retrieval Augmented Personalized Image Generation Guided by Recommendation
par: Ling, Run, et autres
Publié: (2025)
par: Ling, Run, et autres
Publié: (2025)
RAT: Retrieval-Augmented Transformer for Click-Through Rate Prediction
par: Li, Yushen, et autres
Publié: (2024)
par: Li, Yushen, et autres
Publié: (2024)
EndoFinder: Online Image Retrieval for Explainable Colorectal Polyp Diagnosis
par: Yang, Ruijie, et autres
Publié: (2024)
par: Yang, Ruijie, et autres
Publié: (2024)
An Efficient Post-hoc Framework for Reducing Task Discrepancy of Text Encoders for Composed Image Retrieval
par: Byun, Jaeseok, et autres
Publié: (2024)
par: Byun, Jaeseok, et autres
Publié: (2024)
AutothinkRAG: Complexity-Aware Control of Retrieval-Augmented Reasoning for Image-Text Interaction
par: Yang, Jiashu, et autres
Publié: (2026)
par: Yang, Jiashu, et autres
Publié: (2026)
Entity Image and Mixed-Modal Image Retrieval Datasets
par: Blaga, Cristian-Ioan, et autres
Publié: (2025)
par: Blaga, Cristian-Ioan, et autres
Publié: (2025)
From Swath to Full-Disc: Advancing Precipitation Retrieval with Multimodal Knowledge Expansion
par: Wang, Zheng, et autres
Publié: (2025)
par: Wang, Zheng, et autres
Publié: (2025)
Human-Oriented Image Retrieval System (HORSE): A Neuro-Symbolic Approach to Optimizing Retrieval of Previewed Images
par: Weinberg, Abraham Itzhak
Publié: (2025)
par: Weinberg, Abraham Itzhak
Publié: (2025)
Global-to-Local or Local-to-Global? Enhancing Image Retrieval with Efficient Local Search and Effective Global Re-ranking
par: Aiger, Dror, et autres
Publié: (2025)
par: Aiger, Dror, et autres
Publié: (2025)
UNION: A Lightweight Target Representation for Efficient Zero-Shot Image-Guided Retrieval with Optional Textual Queries
par: Le, Hoang-Bao, et autres
Publié: (2025)
par: Le, Hoang-Bao, et autres
Publié: (2025)
Video Editing for Video Retrieval
par: Zhu, Bin, et autres
Publié: (2024)
par: Zhu, Bin, et autres
Publié: (2024)
Snap and Diagnose: An Advanced Multimodal Retrieval System for Identifying Plant Diseases in the Wild
par: Wei, Tianqi, et autres
Publié: (2024)
par: Wei, Tianqi, et autres
Publié: (2024)
Documents similaires
-
GMMFormer: Gaussian-Mixture-Model Based Transformer for Efficient Partially Relevant Video Retrieval
par: Wang, Yuting, et autres
Publié: (2023) -
Weakly Supervised Deep Hyperspherical Quantization for Image Retrieval
par: Wang, Jinpeng, et autres
Publié: (2024) -
Imagine Before Concentration: Diffusion-Guided Registers Enhance Partially Relevant Video Retrieval
par: Li, Jun, et autres
Publié: (2026) -
AutoSSVH: Exploring Automated Frame Sampling for Efficient Self-Supervised Video Hashing
par: Lian, Niu, et autres
Publié: (2025) -
HLFormer: Enhancing Partially Relevant Video Retrieval with Hyperbolic Learning
par: Li, Jun, et autres
Publié: (2025)