CFIR: Fast and Effective Long-Text To Image Retrieval for Large Corpora
Fuente:
arXiv
Guardado en:
| Autores principales: | Long, Zijun, Ge, Xuri, Mccreadie, Richard, Jose, Joemon |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Diffusion Augmented Retrieval: A Training-Free Approach to Interactive Text-to-Image Retrieval
por: Long, Zijun, et al.
Publicado: (2025)
por: Long, Zijun, et al.
Publicado: (2025)
ADaFuSE: Adaptive Diffusion-generated Image and Text Fusion for Interactive Text-to-Image Retrieval
por: Zhang, Zhuocheng, et al.
Publicado: (2026)
por: Zhang, Zhuocheng, et al.
Publicado: (2026)
Hire: Hybrid-modal Interaction with Multiple Relational Enhancements for Image-Text Matching
por: Ge, Xuri, et al.
Publicado: (2024)
por: Ge, Xuri, et al.
Publicado: (2024)
Efficient and Effective Adaptation of Multimodal Foundation Models in Sequential Recommendation
por: Fu, Junchen, et al.
Publicado: (2024)
por: Fu, Junchen, et al.
Publicado: (2024)
Benchmark Granularity and Model Robustness for Image-Text Retrieval
por: Hendriksen, Mariya, et al.
Publicado: (2024)
por: Hendriksen, Mariya, et al.
Publicado: (2024)
IISAN: Efficiently Adapting Multimodal Representation for Sequential Recommendation with Decoupled PEFT
por: Fu, Junchen, et al.
Publicado: (2024)
por: Fu, Junchen, et al.
Publicado: (2024)
Invisible Relevance Bias: Text-Image Retrieval Models Prefer AI-Generated Images
por: Xu, Shicheng, et al.
Publicado: (2023)
por: Xu, Shicheng, et al.
Publicado: (2023)
Scale Up Composed Image Retrieval Learning via Modification Text Generation
por: Zhou, Yinan, et al.
Publicado: (2025)
por: Zhou, Yinan, et al.
Publicado: (2025)
Benchmarking Multimodal Large Language Models for Missing Modality Completion in Product Catalogues
por: Fu, Junchen, et al.
Publicado: (2026)
por: Fu, Junchen, et al.
Publicado: (2026)
VideoRAG: Retrieval-Augmented Generation with Extreme Long-Context Videos
por: Ren, Xubin, et al.
Publicado: (2025)
por: Ren, Xubin, et al.
Publicado: (2025)
MS-DPPs: Multi-Source Determinantal Point Processes for Contextual Diversity Refinement of Composite Attributes in Text to Image Retrieval
por: Sogi, Naoya, et al.
Publicado: (2025)
por: Sogi, Naoya, et al.
Publicado: (2025)
INQUIRE: A Natural World Text-to-Image Retrieval Benchmark
por: Vendrow, Edward, et al.
Publicado: (2024)
por: Vendrow, Edward, et al.
Publicado: (2024)
Weakly Supervised Deep Hyperspherical Quantization for Image Retrieval
por: Wang, Jinpeng, et al.
Publicado: (2024)
por: Wang, Jinpeng, et al.
Publicado: (2024)
Retrieval-Guided Generation for Safer Histopathology Image Captioning
por: Hoq, Md. Enamul, et al.
Publicado: (2026)
por: Hoq, Md. Enamul, et al.
Publicado: (2026)
Neurosymbolic Inference On Foundation Models For Remote Sensing Text-to-image Retrieval With Complex Queries
por: Mezzi, Emanuele, et al.
Publicado: (2025)
por: Mezzi, Emanuele, et al.
Publicado: (2025)
UniversalRAG: Retrieval-Augmented Generation over Corpora of Diverse Modalities and Granularities
por: Yeo, Woongyeong, et al.
Publicado: (2025)
por: Yeo, Woongyeong, et al.
Publicado: (2025)
Attributes Grouping and Mining Hashing for Fine-Grained Image Retrieval
por: Lu, Xin, et al.
Publicado: (2023)
por: Lu, Xin, et al.
Publicado: (2023)
Content-Based Image Retrieval for Multi-Class Volumetric Radiology Images: A Benchmark Study
por: Jush, Farnaz Khun, et al.
Publicado: (2024)
por: Jush, Farnaz Khun, et al.
Publicado: (2024)
CaLa: Complementary Association Learning for Augmenting Composed Image Retrieval
por: Jiang, Xintong, et al.
Publicado: (2024)
por: Jiang, Xintong, et al.
Publicado: (2024)
PHPQ: Pyramid Hybrid Pooling Quantization for Efficient Fine-Grained Image Retrieval
por: Zeng, Ziyun, et al.
Publicado: (2021)
por: Zeng, Ziyun, et al.
Publicado: (2021)
Multi-task Cross-modal Learning for Chest X-ray Image Retrieval
por: Liang, Zhaohui, et al.
Publicado: (2026)
por: Liang, Zhaohui, et al.
Publicado: (2026)
Are They the Same Picture? Adapting Concept Bottleneck Models for Human-AI Collaboration in Image Retrieval
por: Balloli, Vaibhav, et al.
Publicado: (2024)
por: Balloli, Vaibhav, et al.
Publicado: (2024)
DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval
por: Yang, Yuxin, et al.
Publicado: (2025)
por: Yang, Yuxin, et al.
Publicado: (2025)
Compressible and Searchable: AI-native Multi-Modal Retrieval System with Learned Image Compression
por: Luo, Jixiang
Publicado: (2024)
por: Luo, Jixiang
Publicado: (2024)
MMDocIR: Benchmarking Multimodal Retrieval for Long Documents
por: Dong, Kuicai, et al.
Publicado: (2025)
por: Dong, Kuicai, et al.
Publicado: (2025)
A Comprehensive Survey on Composed Image Retrieval
por: Song, Xuemeng, et al.
Publicado: (2025)
por: Song, Xuemeng, et al.
Publicado: (2025)
Content-based 3D Image Retrieval and a ColBERT-inspired Re-ranking for Tumor Flagging and Staging
por: Jush, Farnaz Khun, et al.
Publicado: (2025)
por: Jush, Farnaz Khun, et al.
Publicado: (2025)
HotelMatch-LLM: Joint Multi-Task Training of Small and Large Language Models for Efficient Multimodal Hotel Retrieval
por: Askari, Arian, et al.
Publicado: (2025)
por: Askari, Arian, et al.
Publicado: (2025)
An Empirical Study of Excitation and Aggregation Design Adaptions in CLIP4Clip for Video-Text Retrieval
por: Jing, Xiaolun, et al.
Publicado: (2024)
por: Jing, Xiaolun, et al.
Publicado: (2024)
RAVEN: Multitask Retrieval Augmented Vision-Language Learning
por: Rao, Varun Nagaraj, et al.
Publicado: (2024)
por: Rao, Varun Nagaraj, et al.
Publicado: (2024)
Smart Routing for Multimodal Video Retrieval: When to Search What
por: Rosa, Kevin Dela
Publicado: (2025)
por: Rosa, Kevin Dela
Publicado: (2025)
Self-supervised Graph Neural Network for Mechanical CAD Retrieval
por: Quan, Yuhan, et al.
Publicado: (2024)
por: Quan, Yuhan, et al.
Publicado: (2024)
OMGM: Orchestrate Multiple Granularities and Modalities for Efficient Multimodal Retrieval
por: Yang, Wei, et al.
Publicado: (2025)
por: Yang, Wei, et al.
Publicado: (2025)
Capability-aware Prompt Reformulation Learning for Text-to-Image Generation
por: Zhan, Jingtao, et al.
Publicado: (2024)
por: Zhan, Jingtao, et al.
Publicado: (2024)
Video Enriched Retrieval Augmented Generation Using Aligned Video Captions
por: Rosa, Kevin Dela
Publicado: (2024)
por: Rosa, Kevin Dela
Publicado: (2024)
Enhancing Subsequent Video Retrieval via Vision-Language Models (VLMs)
por: Duan, Yicheng, et al.
Publicado: (2025)
por: Duan, Yicheng, et al.
Publicado: (2025)
HV-Attack: Hierarchical Visual Attack for Multimodal Retrieval Augmented Generation
por: Luo, Linyin, et al.
Publicado: (2025)
por: Luo, Linyin, et al.
Publicado: (2025)
ITSELF: Attention Guided Fine-Grained Alignment for Vision-Language Retrieval
por: Nguyen, Tien-Huy, et al.
Publicado: (2026)
por: Nguyen, Tien-Huy, et al.
Publicado: (2026)
ContextIQ: A Multimodal Expert-Based Video Retrieval System for Contextual Advertising
por: Chaubey, Ashutosh, et al.
Publicado: (2024)
por: Chaubey, Ashutosh, et al.
Publicado: (2024)
CRISP -- Clustering-Based Redundancy-Reduced Instance Sampling for Pathology Case Representation and Retrieval
por: Afzal, Zahra Rahimi, et al.
Publicado: (2026)
por: Afzal, Zahra Rahimi, et al.
Publicado: (2026)
Ejemplares similares
-
Diffusion Augmented Retrieval: A Training-Free Approach to Interactive Text-to-Image Retrieval
por: Long, Zijun, et al.
Publicado: (2025) -
ADaFuSE: Adaptive Diffusion-generated Image and Text Fusion for Interactive Text-to-Image Retrieval
por: Zhang, Zhuocheng, et al.
Publicado: (2026) -
Hire: Hybrid-modal Interaction with Multiple Relational Enhancements for Image-Text Matching
por: Ge, Xuri, et al.
Publicado: (2024) -
Efficient and Effective Adaptation of Multimodal Foundation Models in Sequential Recommendation
por: Fu, Junchen, et al.
Publicado: (2024) -
Benchmark Granularity and Model Robustness for Image-Text Retrieval
por: Hendriksen, Mariya, et al.
Publicado: (2024)