Learning to Route Queries to Heads for Attention-based Re-ranking with Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Tian, Yuxing, Mo, Fengran, Huang, Zhiqi, Zhang, Weixu, Nie, Jian-Yun |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ReAttn: Improving Attention-based Re-ranking via Attention Re-weighting
by: Tian, Yuxing, et al.
Published: (2026)
by: Tian, Yuxing, et al.
Published: (2026)
ConvGQR: Generative Query Reformulation for Conversational Search
by: Mo, Fengran, et al.
Published: (2023)
by: Mo, Fengran, et al.
Published: (2023)
Aligning Query Representation with Rewritten Query and Relevance Judgments in Conversational Search
by: Mo, Fengran, et al.
Published: (2024)
by: Mo, Fengran, et al.
Published: (2024)
OpenDecoder: Open Large Language Model Decoding to Incorporate Document Quality in RAG
by: Mo, Fengran, et al.
Published: (2026)
by: Mo, Fengran, et al.
Published: (2026)
Adaptive Personalized Conversational Information Retrieval
by: Mo, Fengran, et al.
Published: (2025)
by: Mo, Fengran, et al.
Published: (2025)
Conversational Search: From Fundamentals to Frontiers in the LLM Era
by: Mo, Fengran, et al.
Published: (2025)
by: Mo, Fengran, et al.
Published: (2025)
CHIQ: Contextual History Enhancement for Improving Query Rewriting in Conversational Search
by: Mo, Fengran, et al.
Published: (2024)
by: Mo, Fengran, et al.
Published: (2024)
How to Leverage Personal Textual Knowledge for Personalized Conversational Information Retrieval
by: Mo, Fengran, et al.
Published: (2024)
by: Mo, Fengran, et al.
Published: (2024)
CroSearch-R1: Better Leveraging Cross-lingual Knowledge for Retrieval-Augmented Generation
by: Qi, Rui, et al.
Published: (2026)
by: Qi, Rui, et al.
Published: (2026)
ConvSDG: Session Data Generation for Conversational Search
by: Mo, Fengran, et al.
Published: (2024)
by: Mo, Fengran, et al.
Published: (2024)
History-Aware Conversational Dense Retrieval
by: Mo, Fengran, et al.
Published: (2024)
by: Mo, Fengran, et al.
Published: (2024)
Rethinking On-policy Optimization for Query Augmentation
by: Xu, Zhichao, et al.
Published: (2025)
by: Xu, Zhichao, et al.
Published: (2025)
Language Modeling Using Tensor Trains
by: Su, Zhan, et al.
Published: (2024)
by: Su, Zhan, et al.
Published: (2024)
ConvMix: A Mixed-Criteria Data Augmentation Framework for Conversational Dense Retrieval
by: Mo, Fengran, et al.
Published: (2025)
by: Mo, Fengran, et al.
Published: (2025)
The Attention Market: Interpreting Online Fair Re-ranking as Manifold Optimization under Walrasian Equilibrium
by: Xu, Chen, et al.
Published: (2026)
by: Xu, Chen, et al.
Published: (2026)
QExplorer: Large Language Model Based Query Extraction for Toxic Content Exploration
by: Ren, Shaola, et al.
Published: (2025)
by: Ren, Shaola, et al.
Published: (2025)
ChatRetriever: Adapting Large Language Models for Generalized and Robust Conversational Dense Retrieval
by: Mao, Kelong, et al.
Published: (2024)
by: Mao, Kelong, et al.
Published: (2024)
RALI@TREC iKAT 2024: Achieving Personalization via Retrieval Fusion in Conversational Search
by: Hui, Yuchen, et al.
Published: (2024)
by: Hui, Yuchen, et al.
Published: (2024)
Metacognitive Retrieval-Augmented Large Language Models
by: Zhou, Yujia, et al.
Published: (2024)
by: Zhou, Yujia, et al.
Published: (2024)
Synthetic Query Generation using Large Language Models for Virtual Assistants
by: Sannigrahi, Sonal, et al.
Published: (2024)
by: Sannigrahi, Sonal, et al.
Published: (2024)
Improving Tool Retrieval by Leveraging Large Language Models for Query Generation
by: Kachuee, Mohammad, et al.
Published: (2024)
by: Kachuee, Mohammad, et al.
Published: (2024)
DEGAP: Dual Event-Guided Adaptive Prefixes for Templated-Based Event Argument Extraction with Slot Querying
by: Wang, Guanghui, et al.
Published: (2024)
by: Wang, Guanghui, et al.
Published: (2024)
You Only Use Reactive Attention Slice For Long Context Retrieval
by: Soh, Yun Joon, et al.
Published: (2024)
by: Soh, Yun Joon, et al.
Published: (2024)
Re-Rankers as Relevance Judges
by: Meng, Chuan, et al.
Published: (2026)
by: Meng, Chuan, et al.
Published: (2026)
MILL: Mutual Verification with Large Language Models for Zero-Shot Query Expansion
by: Jia, Pengyue, et al.
Published: (2023)
by: Jia, Pengyue, et al.
Published: (2023)
Exploring the Best Practices of Query Expansion with Large Language Models
by: Zhang, Le, et al.
Published: (2024)
by: Zhang, Le, et al.
Published: (2024)
Parametric Retrieval-Augmented Generation using Latent Routing of LoRA Adapters
by: Su, Zhan, et al.
Published: (2025)
by: Su, Zhan, et al.
Published: (2025)
Exp4Fuse: A Rank Fusion Framework for Enhanced Sparse Retrieval using Large Language Model-based Query Expansion
by: Liu, Lingyuan, et al.
Published: (2025)
by: Liu, Lingyuan, et al.
Published: (2025)
CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG
by: Tian, Yang, et al.
Published: (2025)
by: Tian, Yang, et al.
Published: (2025)
From General to Specific: Tailoring Large Language Models for Personalized Healthcare
by: Shi, Ruize, et al.
Published: (2024)
by: Shi, Ruize, et al.
Published: (2024)
Unifying Graph Convolution and Contrastive Learning in Collaborative Filtering
by: Wu, Yihong, et al.
Published: (2024)
by: Wu, Yihong, et al.
Published: (2024)
A Survey of Conversational Search
by: Mo, Fengran, et al.
Published: (2024)
by: Mo, Fengran, et al.
Published: (2024)
SymRAG: Efficient Neuro-Symbolic Retrieval Through Adaptive Query Routing
by: Hakim, Safayat Bin, et al.
Published: (2025)
by: Hakim, Safayat Bin, et al.
Published: (2025)
Attention in Large Language Models Yields Efficient Zero-Shot Re-Rankers
by: Chen, Shijie, et al.
Published: (2024)
by: Chen, Shijie, et al.
Published: (2024)
Towards Dynamic Dense Retrieval with Routing Strategy
by: Su, Zhan, et al.
Published: (2026)
by: Su, Zhan, et al.
Published: (2026)
Distillation and Refinement of Reasoning in Small Language Models for Document Re-ranking
by: Samarinas, Chris, et al.
Published: (2025)
by: Samarinas, Chris, et al.
Published: (2025)
UniConv: Unifying Retrieval and Response Generation for Large Language Models in Conversations
by: Mo, Fengran, et al.
Published: (2025)
by: Mo, Fengran, et al.
Published: (2025)
InstUPR : Instruction-based Unsupervised Passage Reranking with Large Language Models
by: Huang, Chao-Wei, et al.
Published: (2024)
by: Huang, Chao-Wei, et al.
Published: (2024)
Unsupervised Information Refinement Training of Large Language Models for Retrieval-Augmented Generation
by: Xu, Shicheng, et al.
Published: (2024)
by: Xu, Shicheng, et al.
Published: (2024)
When Text Embedding Meets Large Language Model: A Comprehensive Survey
by: Nie, Zhijie, et al.
Published: (2024)
by: Nie, Zhijie, et al.
Published: (2024)
Similar Items
-
ReAttn: Improving Attention-based Re-ranking via Attention Re-weighting
by: Tian, Yuxing, et al.
Published: (2026) -
ConvGQR: Generative Query Reformulation for Conversational Search
by: Mo, Fengran, et al.
Published: (2023) -
Aligning Query Representation with Rewritten Query and Relevance Judgments in Conversational Search
by: Mo, Fengran, et al.
Published: (2024) -
OpenDecoder: Open Large Language Model Decoding to Incorporate Document Quality in RAG
by: Mo, Fengran, et al.
Published: (2026) -
Adaptive Personalized Conversational Information Retrieval
by: Mo, Fengran, et al.
Published: (2025)