Multi-Vector Index Compression in Any Modality
Fuente:
arXiv
Guardado en:
| Autores principales: | Qin, Hanxiang, Martin, Alexander, Jha, Rohan, Zuo, Chunsheng, Kriz, Reno, Van Durme, Benjamin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Brief Comparison of Training-Free Multi-Vector Sequence Compression Methods
por: Jha, Rohan, et al.
Publicado: (2026)
por: Jha, Rohan, et al.
Publicado: (2026)
RANKVIDEO: Reasoning Reranking for Text-to-Video Retrieval
por: Skow, Tyler, et al.
Publicado: (2026)
por: Skow, Tyler, et al.
Publicado: (2026)
Seeing Through the MiRAGE: Evaluating Multimodal Retrieval Augmented Generation
por: Martin, Alexander, et al.
Publicado: (2025)
por: Martin, Alexander, et al.
Publicado: (2025)
MARQUIS: A Three-Stage Pipeline for Video Retrieval-Augmented Generation
por: Chakraborty, Debashish, et al.
Publicado: (2026)
por: Chakraborty, Debashish, et al.
Publicado: (2026)
A Replicability Study of XTR
por: Jha, Rohan, et al.
Publicado: (2026)
por: Jha, Rohan, et al.
Publicado: (2026)
Video-ColBERT: Contextualized Late Interaction for Text-to-Video Retrieval
por: Reddy, Arun, et al.
Publicado: (2025)
por: Reddy, Arun, et al.
Publicado: (2025)
Structural Anchor Pruning: Training-Free Multi-Vector Compression for Visual Document Retrieval
por: Liu, Zhuchenyang, et al.
Publicado: (2026)
por: Liu, Zhuchenyang, et al.
Publicado: (2026)
Sculpting the Vector Space: Towards Efficient Multi-Vector Visual Document Retrieval via Prune-then-Merge Framework
por: Yan, Yibo, et al.
Publicado: (2026)
por: Yan, Yibo, et al.
Publicado: (2026)
VISTA: Visualized Text Embedding For Universal Multi-Modal Retrieval
por: Zhou, Junjie, et al.
Publicado: (2024)
por: Zhou, Junjie, et al.
Publicado: (2024)
ReinPool: Reinforcement Learning Pooling Multi-Vector Embeddings for Retrieval System
por: Cha, Sungguk, et al.
Publicado: (2026)
por: Cha, Sungguk, et al.
Publicado: (2026)
Multi-Field Adaptive Retrieval
por: Li, Millicent, et al.
Publicado: (2024)
por: Li, Millicent, et al.
Publicado: (2024)
NevIR: Negation in Neural Information Retrieval
por: Weller, Orion, et al.
Publicado: (2023)
por: Weller, Orion, et al.
Publicado: (2023)
Efficient and High-Fidelity Omni Modality Retrieval
por: Huynh, Chuong, et al.
Publicado: (2026)
por: Huynh, Chuong, et al.
Publicado: (2026)
Indexing Multimodal Language Models for Large-scale Image Retrieval
por: Tharwat, Bahey, et al.
Publicado: (2026)
por: Tharwat, Bahey, et al.
Publicado: (2026)
AGRaME: Any-Granularity Ranking with Multi-Vector Embeddings
por: Reddy, Revanth Gangi, et al.
Publicado: (2024)
por: Reddy, Revanth Gangi, et al.
Publicado: (2024)
Grounding Partially-Defined Events in Multimodal Data
por: Sanders, Kate, et al.
Publicado: (2024)
por: Sanders, Kate, et al.
Publicado: (2024)
Index Light, Reason Deep: Deferred Visual Ingestion for Visual-Dense Document Question Answering
por: Xu, Tao
Publicado: (2026)
por: Xu, Tao
Publicado: (2026)
From Videos to Indexed Knowledge Graphs -- Framework to Marry Methods for Multimodal Content Analysis and Understanding
por: Rizk, Basem, et al.
Publicado: (2025)
por: Rizk, Basem, et al.
Publicado: (2025)
Hierarchical Patch Compression for ColPali: Efficient Multi-Vector Document Retrieval with Dynamic Pruning and Quantization
por: Bach, Duong
Publicado: (2025)
por: Bach, Duong
Publicado: (2025)
WikiVideo: Article Generation from Multiple Videos
por: Martin, Alexander, et al.
Publicado: (2025)
por: Martin, Alexander, et al.
Publicado: (2025)
Smart Multi-Modal Search: Contextual Sparse and Dense Embedding Integration in Adobe Express
por: Aroraa, Cherag, et al.
Publicado: (2024)
por: Aroraa, Cherag, et al.
Publicado: (2024)
MMMORRF: Multimodal Multilingual Modularized Reciprocal Rank Fusion
por: Samuel, Saron, et al.
Publicado: (2025)
por: Samuel, Saron, et al.
Publicado: (2025)
Defending Against Disinformation Attacks in Open-Domain Question Answering
por: Weller, Orion, et al.
Publicado: (2022)
por: Weller, Orion, et al.
Publicado: (2022)
Hybrid-Vector Retrieval for Visually Rich Documents: Combining Single-Vector Efficiency and Multi-Vector Accuracy
por: Kim, Juyeon, et al.
Publicado: (2025)
por: Kim, Juyeon, et al.
Publicado: (2025)
Compressible and Searchable: AI-native Multi-Modal Retrieval System with Learned Image Compression
por: Luo, Jixiang
Publicado: (2024)
por: Luo, Jixiang
Publicado: (2024)
Towards Natural Language-Based Document Image Retrieval: New Dataset and Benchmark
por: Guo, Hao, et al.
Publicado: (2025)
por: Guo, Hao, et al.
Publicado: (2025)
It's Not a Modality Gap: Characterizing and Addressing the Contrastive Gap
por: Fahim, Abrar, et al.
Publicado: (2024)
por: Fahim, Abrar, et al.
Publicado: (2024)
RE-AdaptIR: Improving Information Retrieval through Reverse Engineered Adaptation
por: Fleshman, William, et al.
Publicado: (2024)
por: Fleshman, William, et al.
Publicado: (2024)
Reversed in Time: A Novel Temporal-Emphasized Benchmark for Cross-Modal Video-Text Retrieval
por: Du, Yang, et al.
Publicado: (2024)
por: Du, Yang, et al.
Publicado: (2024)
CollEX -- A Multimodal Agentic RAG System Enabling Interactive Exploration of Scientific Collections
por: Schneider, Florian, et al.
Publicado: (2025)
por: Schneider, Florian, et al.
Publicado: (2025)
Design Your Ad: Personalized Advertising Image and Text Generation with Unified Autoregressive Models
por: Xu, Yexing, et al.
Publicado: (2026)
por: Xu, Yexing, et al.
Publicado: (2026)
Multimedia-Aware Question Answering: A Review of Retrieval and Cross-Modal Reasoning Architectures
por: Raja, Rahul, et al.
Publicado: (2025)
por: Raja, Rahul, et al.
Publicado: (2025)
Any2Any: Incomplete Multimodal Retrieval with Conformal Prediction
por: Li, Po-han, et al.
Publicado: (2024)
por: Li, Po-han, et al.
Publicado: (2024)
SciMMIR: Benchmarking Scientific Multi-modal Information Retrieval
por: Wu, Siwei, et al.
Publicado: (2024)
por: Wu, Siwei, et al.
Publicado: (2024)
Closing the Modality Gap for Mixed Modality Search
por: Li, Binxu, et al.
Publicado: (2025)
por: Li, Binxu, et al.
Publicado: (2025)
Rank-K: Test-Time Reasoning for Listwise Reranking
por: Yang, Eugene, et al.
Publicado: (2025)
por: Yang, Eugene, et al.
Publicado: (2025)
INQUIRE: A Natural World Text-to-Image Retrieval Benchmark
por: Vendrow, Edward, et al.
Publicado: (2024)
por: Vendrow, Edward, et al.
Publicado: (2024)
$M^3EL$: A Multi-task Multi-topic Dataset for Multi-modal Entity Linking
por: Wang, Fang, et al.
Publicado: (2024)
por: Wang, Fang, et al.
Publicado: (2024)
Improving Applicability of Deep Learning based Token Classification models during Training
por: Mehra, Anket, et al.
Publicado: (2025)
por: Mehra, Anket, et al.
Publicado: (2025)
Think When Needed: Adaptive Reasoning-Driven Multimodal Embeddings with a Dual-LoRA Architecture
por: Zhang, Longxiang, et al.
Publicado: (2026)
por: Zhang, Longxiang, et al.
Publicado: (2026)
Ejemplares similares
-
A Brief Comparison of Training-Free Multi-Vector Sequence Compression Methods
por: Jha, Rohan, et al.
Publicado: (2026) -
RANKVIDEO: Reasoning Reranking for Text-to-Video Retrieval
por: Skow, Tyler, et al.
Publicado: (2026) -
Seeing Through the MiRAGE: Evaluating Multimodal Retrieval Augmented Generation
por: Martin, Alexander, et al.
Publicado: (2025) -
MARQUIS: A Three-Stage Pipeline for Video Retrieval-Augmented Generation
por: Chakraborty, Debashish, et al.
Publicado: (2026) -
A Replicability Study of XTR
por: Jha, Rohan, et al.
Publicado: (2026)