ColPali: Efficient Document Retrieval with Vision Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Faysse, Manuel, Sibille, Hugues, Wu, Tony, Omrani, Bilel, Viaud, Gautier, Hudelot, Céline, Colombo, Pierre |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Context is Gold to find the Gold Passage: Evaluating and Training Contextual Document Embeddings
by: Conti, Max, et al.
Published: (2025)
by: Conti, Max, et al.
Published: (2025)
Hierarchical Patch Compression for ColPali: Efficient Multi-Vector Document Retrieval with Dynamic Pruning and Quantization
by: Bach, Duong
Published: (2025)
by: Bach, Duong
Published: (2025)
Retrieval-Augmented Search for Large-Scale Map Collections with ColPali
by: Mahowald, Jamie, et al.
Published: (2025)
by: Mahowald, Jamie, et al.
Published: (2025)
Towards Trustworthy Reranking: A Simple yet Effective Abstention Mechanism
by: Gisserot-Boukhlef, Hippolyte, et al.
Published: (2024)
by: Gisserot-Boukhlef, Hippolyte, et al.
Published: (2024)
ModernVBERT: Towards Smaller Visual Document Retrievers
by: Teiletche, Paul, et al.
Published: (2025)
by: Teiletche, Paul, et al.
Published: (2025)
ColBERT Retrieval and Ensemble Response Scoring for Language Model Question Answering
by: Gichamba, Alex, et al.
Published: (2024)
by: Gichamba, Alex, et al.
Published: (2024)
ViDoRe Benchmark V2: Raising the Bar for Visual Retrieval
by: Macé, Quentin, et al.
Published: (2025)
by: Macé, Quentin, et al.
Published: (2025)
FGR-ColBERT: Identifying Fine-Grained Relevance Tokens During Retrieval
by: Jarolím, Antonín, et al.
Published: (2026)
by: Jarolím, Antonín, et al.
Published: (2026)
GroUSE: A Benchmark to Evaluate Evaluators in Grounded Question Answering
by: Muller, Sacha, et al.
Published: (2024)
by: Muller, Sacha, et al.
Published: (2024)
ColBERT-Zero: To Pre-train Or Not To Pre-train ColBERT models
by: Chaffin, Antoine, et al.
Published: (2026)
by: Chaffin, Antoine, et al.
Published: (2026)
Extending Translate-Train for ColBERT-X to African Language CLIR
by: Yang, Eugene, et al.
Published: (2024)
by: Yang, Eugene, et al.
Published: (2024)
ColBERT-XM: A Modular Multi-Vector Representation Model for Zero-Shot Multilingual Information Retrieval
by: Louis, Antoine, et al.
Published: (2024)
by: Louis, Antoine, et al.
Published: (2024)
Diagnosable ColBERT: Debugging Late-Interaction Retrieval Models Using a Learned Latent Space as Reference
by: Remy, François
Published: (2026)
by: Remy, François
Published: (2026)
Video-ColBERT: Contextualized Late Interaction for Text-to-Video Retrieval
by: Reddy, Arun, et al.
Published: (2025)
by: Reddy, Arun, et al.
Published: (2025)
Summarization-Based Document IDs for Generative Retrieval with Language Models
by: Li, Haoxin, et al.
Published: (2023)
by: Li, Haoxin, et al.
Published: (2023)
Towards Storage-Efficient Visual Document Retrieval: An Empirical Study on Reducing Patch-Level Embeddings
by: Ma, Yubo, et al.
Published: (2025)
by: Ma, Yubo, et al.
Published: (2025)
Making Large Language Models Efficient Dense Retrievers
by: Lei, Yibin, et al.
Published: (2025)
by: Lei, Yibin, et al.
Published: (2025)
ArchSeek: Retrieving Architectural Case Studies Using Vision-Language Models
by: Li, Danrui, et al.
Published: (2025)
by: Li, Danrui, et al.
Published: (2025)
Dwell in the Beginning: How Language Models Embed Long Documents for Dense Retrieval
by: Coelho, João, et al.
Published: (2024)
by: Coelho, João, et al.
Published: (2024)
TurkColBERT: A Benchmark of Dense and Late-Interaction Models for Turkish Information Retrieval
by: Ezerceli, Özay, et al.
Published: (2025)
by: Ezerceli, Özay, et al.
Published: (2025)
JaColBERTv2.5: Optimising Multi-Vector Retrievers to Create State-of-the-Art Japanese Retrievers with Constrained Resources
by: Clavié, Benjamin
Published: (2024)
by: Clavié, Benjamin
Published: (2024)
Human-Computer Interaction as a basis for assessing Geographic Information Retrieval Systems.
by: Manuel Enrique Puebla Martínez
Published: (2018)
by: Manuel Enrique Puebla Martínez
Published: (2018)
Enhancing Document Retrieval in COVID-19 Research: Leveraging Large Language Models for Hidden Relation Extraction
by: Trieu, Hoang-An, et al.
Published: (2025)
by: Trieu, Hoang-An, et al.
Published: (2025)
A Large Language Model-based Framework for Semi-Structured Tender Document Retrieval-Augmented Generation
by: Zhao, Yilong, et al.
Published: (2024)
by: Zhao, Yilong, et al.
Published: (2024)
MoLoRAG: Bootstrapping Document Understanding via Multi-modal Logic-aware Retrieval
by: Wu, Xixi, et al.
Published: (2025)
by: Wu, Xixi, et al.
Published: (2025)
Recall Them All: Retrieval-Augmented Language Models for Long Object List Extraction from Long Documents
by: Singhania, Sneha, et al.
Published: (2024)
by: Singhania, Sneha, et al.
Published: (2024)
CLIRudit: Cross-Lingual Information Retrieval of Scientific Documents
by: Valentini, Francisco, et al.
Published: (2025)
by: Valentini, Francisco, et al.
Published: (2025)
Improving Document Retrieval Coherence for Semantically Equivalent Queries
by: Campese, Stefano, et al.
Published: (2025)
by: Campese, Stefano, et al.
Published: (2025)
DAPR: A Benchmark on Document-Aware Passage Retrieval
by: Wang, Kexin, et al.
Published: (2023)
by: Wang, Kexin, et al.
Published: (2023)
Context-Efficient Retrieval with Factual Decomposition
by: Li, Yanhong, et al.
Published: (2025)
by: Li, Yanhong, et al.
Published: (2025)
Revela: Dense Retriever Learning via Language Modeling
by: Cai, Fengyu, et al.
Published: (2025)
by: Cai, Fengyu, et al.
Published: (2025)
Unlocking Multimodal Document Intelligence: From Current Triumphs to Future Frontiers of Visual Document Retrieval
by: Yan, Yibo, et al.
Published: (2026)
by: Yan, Yibo, et al.
Published: (2026)
Document Optimization for Black-Box Retrieval via Reinforcement Learning
by: Uzan, Omri, et al.
Published: (2026)
by: Uzan, Omri, et al.
Published: (2026)
NEAR$^2$: A Nested Embedding Approach to Efficient Product Retrieval and Ranking
by: Qian, Shenbin, et al.
Published: (2025)
by: Qian, Shenbin, et al.
Published: (2025)
DocPruner: A Storage-Efficient Framework for Multi-Vector Visual Document Retrieval via Adaptive Patch-Level Embedding Pruning
by: Yan, Yibo, et al.
Published: (2025)
by: Yan, Yibo, et al.
Published: (2025)
DIRAS: Efficient LLM Annotation of Document Relevance in Retrieval Augmented Generation
by: Ni, Jingwei, et al.
Published: (2024)
by: Ni, Jingwei, et al.
Published: (2024)
DocReLM: Mastering Document Retrieval with Language Model
by: Wei, Gengchen, et al.
Published: (2024)
by: Wei, Gengchen, et al.
Published: (2024)
Align then Train: Efficient Retrieval Adapter Learning
by: Maekawa, Seiji, et al.
Published: (2026)
by: Maekawa, Seiji, et al.
Published: (2026)
Efficient Constant-Space Multi-Vector Retrieval
by: MacAvaney, Sean, et al.
Published: (2025)
by: MacAvaney, Sean, et al.
Published: (2025)
Language Fairness in Multilingual Information Retrieval
by: Yang, Eugene, et al.
Published: (2024)
by: Yang, Eugene, et al.
Published: (2024)
Similar Items
-
Context is Gold to find the Gold Passage: Evaluating and Training Contextual Document Embeddings
by: Conti, Max, et al.
Published: (2025) -
Hierarchical Patch Compression for ColPali: Efficient Multi-Vector Document Retrieval with Dynamic Pruning and Quantization
by: Bach, Duong
Published: (2025) -
Retrieval-Augmented Search for Large-Scale Map Collections with ColPali
by: Mahowald, Jamie, et al.
Published: (2025) -
Towards Trustworthy Reranking: A Simple yet Effective Abstention Mechanism
by: Gisserot-Boukhlef, Hippolyte, et al.
Published: (2024) -
ModernVBERT: Towards Smaller Visual Document Retrievers
by: Teiletche, Paul, et al.
Published: (2025)