An Analysis on Matching Mechanisms and Token Pruning for Late-interaction Models
Fuente:
arXiv
Saved in:
| Main Authors: | Liu, Qi, Guo, Gang, Mao, Jiaxin, Dou, Zhicheng, Wen, Ji-Rong, Jiang, Hao, Zhang, Xinyu, Cao, Zhao |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Session-level Normalization and Click-through Data Enhancement for Session-based Evaluation
by: Chen, Haonan, et al.
Published: (2024)
by: Chen, Haonan, et al.
Published: (2024)
How do Large Language Models Understand Relevance? A Mechanistic Interpretability Perspective
by: Liu, Qi, et al.
Published: (2025)
by: Liu, Qi, et al.
Published: (2025)
ChatShopBuddy: Towards Reliable Conversational Shopping Agents via Reinforcement Learning
by: Cheng, Yiruo, et al.
Published: (2026)
by: Cheng, Yiruo, et al.
Published: (2026)
HtmlRAG: HTML is Better Than Plain Text for Modeling Retrieved Knowledge in RAG Systems
by: Tan, Jiejun, et al.
Published: (2024)
by: Tan, Jiejun, et al.
Published: (2024)
Query-oriented Data Augmentation for Session Search
by: Chen, Haonan, et al.
Published: (2024)
by: Chen, Haonan, et al.
Published: (2024)
Interpreting Conversational Dense Retrieval by Rewriting-Enhanced Inversion of Session Embedding
by: Cheng, Yiruo, et al.
Published: (2024)
by: Cheng, Yiruo, et al.
Published: (2024)
Cognitive Personalized Search Integrating Large Language Models with an Efficient Memory Mechanism
by: Zhou, Yujia, et al.
Published: (2024)
by: Zhou, Yujia, et al.
Published: (2024)
Towards Lossless Token Pruning in Late-Interaction Retrieval Models
by: Zong, Yuxuan, et al.
Published: (2025)
by: Zong, Yuxuan, et al.
Published: (2025)
Addressing Personalized Bias for Unbiased Learning to Rank
by: Niu, Zechun, et al.
Published: (2025)
by: Niu, Zechun, et al.
Published: (2025)
Learning Interpretable Legal Case Retrieval via Knowledge-Guided Case Reformulation
by: Deng, Chenlong, et al.
Published: (2024)
by: Deng, Chenlong, et al.
Published: (2024)
FlashRAG: A Modular Toolkit for Efficient Retrieval-Augmented Generation Research
by: Jin, Jiajie, et al.
Published: (2024)
by: Jin, Jiajie, et al.
Published: (2024)
CORAL: Benchmarking Multi-turn Conversational Retrieval-Augmentation Generation
by: Cheng, Yiruo, et al.
Published: (2024)
by: Cheng, Yiruo, et al.
Published: (2024)
MemSifter: Offloading LLM Memory Retrieval via Outcome-Driven Proxy Reasoning
by: Tan, Jiejun, et al.
Published: (2026)
by: Tan, Jiejun, et al.
Published: (2026)
SumRank: Aligning Summarization Models for Long-Document Listwise Reranking
by: Feng, Jincheng, et al.
Published: (2026)
by: Feng, Jincheng, et al.
Published: (2026)
A Voronoi Cell Formulation for Principled Token Pruning in Late-Interaction Retrieval Models
by: Kankanampati, Yash, et al.
Published: (2026)
by: Kankanampati, Yash, et al.
Published: (2026)
Neuro-Symbolic Query Compiler
by: Zhang, Yuyao, et al.
Published: (2025)
by: Zhang, Yuyao, et al.
Published: (2025)
RecThinker: An Agentic Framework for Tool-Augmented Reasoning in Recommendation
by: Zhang, Haobo, et al.
Published: (2026)
by: Zhang, Haobo, et al.
Published: (2026)
Investigating the Robustness of Counterfactual Learning to Rank Models: A Reproducibility Study
by: Niu, Zechun, et al.
Published: (2024)
by: Niu, Zechun, et al.
Published: (2024)
INTERS: Unlocking the Power of Large Language Models in Search with Instruction Tuning
by: Zhu, Yutao, et al.
Published: (2024)
by: Zhu, Yutao, et al.
Published: (2024)
Enhancing Multi-field B2B Cloud Solution Matching via Contrastive Pre-training
by: Chen, Haonan, et al.
Published: (2024)
by: Chen, Haonan, et al.
Published: (2024)
Universal Item Tokenization for Transferable Generative Recommendation
by: Zheng, Bowen, et al.
Published: (2025)
by: Zheng, Bowen, et al.
Published: (2025)
Generative Retrieval via Term Set Generation
by: Zhang, Peitian, et al.
Published: (2023)
by: Zhang, Peitian, et al.
Published: (2023)
R$^3$AG: Retriever Routing for Retrieval-Augmented Generation
by: Zhao, Tong, et al.
Published: (2026)
by: Zhao, Tong, et al.
Published: (2026)
Generalizing Conversational Dense Retrieval via LLM-Cognition Data Augmentation
by: Chen, Haonan, et al.
Published: (2024)
by: Chen, Haonan, et al.
Published: (2024)
DiffuRank: Effective Document Reranking with Diffusion Language Models
by: Liu, Qi, et al.
Published: (2026)
by: Liu, Qi, et al.
Published: (2026)
FairDiverse: A Comprehensive Toolkit for Fair and Diverse Information Retrieval Algorithms
by: Xu, Chen, et al.
Published: (2025)
by: Xu, Chen, et al.
Published: (2025)
Improving GenIR Systems Based on User Feedback
by: Ai, Qingyao, et al.
Published: (2025)
by: Ai, Qingyao, et al.
Published: (2025)
Sliding Windows Are Not the End: Exploring Full Ranking with Long-Context Large Language Models
by: Liu, Wenhan, et al.
Published: (2024)
by: Liu, Wenhan, et al.
Published: (2024)
Rethinking the Evaluation for Conversational Recommendation in the Era of Large Language Models
by: Wang, Xiaolei, et al.
Published: (2023)
by: Wang, Xiaolei, et al.
Published: (2023)
An Efficient Pruning Process with Locality Aware Exploration and Dynamic Graph Editing for Subgraph Matching
by: Jiang, Zite, et al.
Published: (2021)
by: Jiang, Zite, et al.
Published: (2021)
DailyQA: A Benchmark to Evaluate Web Retrieval Augmented LLMs Based on Capturing Real-World Changes
by: Cheng, Jiehan, et al.
Published: (2025)
by: Cheng, Jiehan, et al.
Published: (2025)
DemoRank: Selecting Effective Demonstrations for Large Language Models in Ranking Task
by: Liu, Wenhan, et al.
Published: (2024)
by: Liu, Wenhan, et al.
Published: (2024)
Large Language Models for Information Retrieval: A Survey
by: Zhu, Yutao, et al.
Published: (2023)
by: Zhu, Yutao, et al.
Published: (2023)
Improving Conversational Recommendation Systems via Counterfactual Data Simulation
by: Wang, Xiaolei, et al.
Published: (2023)
by: Wang, Xiaolei, et al.
Published: (2023)
Tapping the Potential of Large Language Models as Recommender Systems: A Comprehensive Framework and Empirical Analysis
by: Xu, Lanling, et al.
Published: (2024)
by: Xu, Lanling, et al.
Published: (2024)
WebThinker: Empowering Large Reasoning Models with Deep Research Capability
by: Li, Xiaoxi, et al.
Published: (2025)
by: Li, Xiaoxi, et al.
Published: (2025)
Col-Bandit: Zero-Shot Query-Time Pruning for Late-Interaction Retrieval
by: Pony, Roi, et al.
Published: (2026)
by: Pony, Roi, et al.
Published: (2026)
ProRAG: Process-Supervised Reinforcement Learning for Retrieval-Augmented Generation
by: Wang, Zhao, et al.
Published: (2026)
by: Wang, Zhao, et al.
Published: (2026)
Pre-training Generative Recommender with Multi-Identifier Item Tokenization
by: Zheng, Bowen, et al.
Published: (2025)
by: Zheng, Bowen, et al.
Published: (2025)
Grounding Language Model with Chunking-Free In-Context Retrieval
by: Qian, Hongjin, et al.
Published: (2024)
by: Qian, Hongjin, et al.
Published: (2024)
Similar Items
-
Session-level Normalization and Click-through Data Enhancement for Session-based Evaluation
by: Chen, Haonan, et al.
Published: (2024) -
How do Large Language Models Understand Relevance? A Mechanistic Interpretability Perspective
by: Liu, Qi, et al.
Published: (2025) -
ChatShopBuddy: Towards Reliable Conversational Shopping Agents via Reinforcement Learning
by: Cheng, Yiruo, et al.
Published: (2026) -
HtmlRAG: HTML is Better Than Plain Text for Modeling Retrieved Knowledge in RAG Systems
by: Tan, Jiejun, et al.
Published: (2024) -
Query-oriented Data Augmentation for Session Search
by: Chen, Haonan, et al.
Published: (2024)