Beyond the limitation of a single query: Train your LLM for query expansion with Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Zhao, Shu, Yu, Tan, Xu, Anbang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ParallelSearch: Train your LLMs to Decompose Query and Search Sub-queries in Parallel with Reinforcement Learning
by: Zhao, Shu, et al.
Published: (2025)
by: Zhao, Shu, et al.
Published: (2025)
RAG-R1: Incentivizing the Search and Reasoning Capabilities of LLMs through Multi-query Parallelism
by: Tan, Zhiwen, et al.
Published: (2025)
by: Tan, Zhiwen, et al.
Published: (2025)
KU-DMIS at EHRSQL 2024:Generating SQL query via question templatization in EHR
by: Kim, Hajung, et al.
Published: (2024)
by: Kim, Hajung, et al.
Published: (2024)
FISHNET: Financial Intelligence from Sub-querying, Harmonizing, Neural-Conditioning, Expert Swarms, and Task Planning
by: Cho, Nicole, et al.
Published: (2024)
by: Cho, Nicole, et al.
Published: (2024)
Optimizing RAG Rerankers with LLM Feedback via Reinforcement Learning
by: Wu, Yuhang, et al.
Published: (2026)
by: Wu, Yuhang, et al.
Published: (2026)
An Empirical Study on Reinforcement Learning for Reasoning-Search Interleaved LLM Agents
by: Jin, Bowen, et al.
Published: (2025)
by: Jin, Bowen, et al.
Published: (2025)
Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning
by: Jin, Bowen, et al.
Published: (2025)
by: Jin, Bowen, et al.
Published: (2025)
ProRAG: Process-Supervised Reinforcement Learning for Retrieval-Augmented Generation
by: Wang, Zhao, et al.
Published: (2026)
by: Wang, Zhao, et al.
Published: (2026)
Explainable LLM-driven Multi-dimensional Distillation for E-Commerce Relevance Learning
by: Zhao, Gang, et al.
Published: (2024)
by: Zhao, Gang, et al.
Published: (2024)
CoSearch: Joint Training of Reasoning and Document Ranking via Reinforcement Learning for Agentic Search
by: Zeng, Hansi, et al.
Published: (2026)
by: Zeng, Hansi, et al.
Published: (2026)
Structure-R1: Dynamically Leveraging Structural Knowledge in LLM Reasoning through Reinforcement Learning
by: Wu, Junlin, et al.
Published: (2025)
by: Wu, Junlin, et al.
Published: (2025)
Beyond Catalogue Counts: the Dataset Visibility Asymmetry in Low-Resource Multilingual NLP
by: Tan, Zhiyin, et al.
Published: (2026)
by: Tan, Zhiyin, et al.
Published: (2026)
Dr Web: a modern, query-based web data retrieval engine
by: Prifti, Ylli, et al.
Published: (2025)
by: Prifti, Ylli, et al.
Published: (2025)
ReCQR: Incorporating conversational query rewriting to improve Multimodal Image Retrieval
by: Hu, Yuan, et al.
Published: (2026)
by: Hu, Yuan, et al.
Published: (2026)
Robust Training for Conversational Question Answering Models with Reinforced Reformulation Generation
by: Kaiser, Magdalena, et al.
Published: (2023)
by: Kaiser, Magdalena, et al.
Published: (2023)
TokenRec: Learning to Tokenize ID for LLM-based Generative Recommendation
by: Qu, Haohao, et al.
Published: (2024)
by: Qu, Haohao, et al.
Published: (2024)
R1-Searcher++: Incentivizing the Dynamic Knowledge Acquisition of LLMs via Reinforcement Learning
by: Song, Huatong, et al.
Published: (2025)
by: Song, Huatong, et al.
Published: (2025)
IQLS: Framework for leveraging Metadata to enable Large Language Model based queries to complex, versatile Data
by: Azirar, Sami, et al.
Published: (2024)
by: Azirar, Sami, et al.
Published: (2024)
Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses
by: Jiang, Pengcheng, et al.
Published: (2026)
by: Jiang, Pengcheng, et al.
Published: (2026)
R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning
by: Song, Huatong, et al.
Published: (2025)
by: Song, Huatong, et al.
Published: (2025)
Thinking Forward and Backward: Multi-Objective Reinforcement Learning for Retrieval-Augmented Reasoning
by: Wei, Wenda, et al.
Published: (2025)
by: Wei, Wenda, et al.
Published: (2025)
Beyond Words: Evaluating Large Language Models in Transportation Planning
by: Ying, Shaowei, et al.
Published: (2024)
by: Ying, Shaowei, et al.
Published: (2024)
Unsupervised Information Refinement Training of Large Language Models for Retrieval-Augmented Generation
by: Xu, Shicheng, et al.
Published: (2024)
by: Xu, Shicheng, et al.
Published: (2024)
Resisting Contextual Interference in RAG via Parametric-Knowledge Reinforcement
by: Lin, Chenyu, et al.
Published: (2025)
by: Lin, Chenyu, et al.
Published: (2025)
Bias and Unfairness in Information Retrieval Systems: New Challenges in the LLM Era
by: Dai, Sunhao, et al.
Published: (2024)
by: Dai, Sunhao, et al.
Published: (2024)
Balancing Accuracy and Efficiency in Multi-Turn Intent Classification for LLM-Powered Dialog Systems in Production
by: Liu, Junhua, et al.
Published: (2024)
by: Liu, Junhua, et al.
Published: (2024)
IDGenRec: LLM-RecSys Alignment with Textual ID Learning
by: Tan, Juntao, et al.
Published: (2024)
by: Tan, Juntao, et al.
Published: (2024)
RecGPT: Generative Personalized Prompts for Sequential Recommendation via ChatGPT Training Paradigm
by: Zhang, Yabin, et al.
Published: (2024)
by: Zhang, Yabin, et al.
Published: (2024)
Erase to Improve: Erasable Reinforcement Learning for Search-Augmented LLMs
by: Wang, Ziliang, et al.
Published: (2025)
by: Wang, Ziliang, et al.
Published: (2025)
Reinforcement Learning Foundations for Deep Research Systems: A Survey
by: Li, Wenjun, et al.
Published: (2025)
by: Li, Wenjun, et al.
Published: (2025)
Enhancing LLM Generation with Knowledge Hypergraph for Evidence-Based Medicine
by: Dou, Chengfeng, et al.
Published: (2025)
by: Dou, Chengfeng, et al.
Published: (2025)
RAG-KG-IL: A Multi-Agent Hybrid Framework for Reducing Hallucinations and Enhancing LLM Reasoning through RAG and Incremental Knowledge Graph Learning Integration
by: Yu, Hong Qing, et al.
Published: (2025)
by: Yu, Hong Qing, et al.
Published: (2025)
Training the Knowledge Base through Evidence Distillation and Write-Back Enrichment
by: Lu, Yuxing, et al.
Published: (2026)
by: Lu, Yuxing, et al.
Published: (2026)
TRAD: Enhancing LLM Agents with Step-Wise Thought Retrieval and Aligned Decision
by: Zhou, Ruiwen, et al.
Published: (2024)
by: Zhou, Ruiwen, et al.
Published: (2024)
A large collection of bioinformatics question-query pairs over federated knowledge graphs: methodology and applications
by: Bolleman, Jerven, et al.
Published: (2024)
by: Bolleman, Jerven, et al.
Published: (2024)
Graph Retrieval-Augmented LLM for Conversational Recommendation Systems
by: Qiu, Zhangchi, et al.
Published: (2025)
by: Qiu, Zhangchi, et al.
Published: (2025)
LLM-MedQA: Enhancing Medical Question Answering through Case Studies in Large Language Models
by: Yang, Hang, et al.
Published: (2024)
by: Yang, Hang, et al.
Published: (2024)
TaoSR-AGRL: Adaptive Guided Reinforcement Learning Framework for E-commerce Search Relevance
by: Yang, Jianhui, et al.
Published: (2025)
by: Yang, Jianhui, et al.
Published: (2025)
RouteRAG: Efficient Retrieval-Augmented Generation from Text and Graph via Reinforcement Learning
by: Guo, Yucan, et al.
Published: (2025)
by: Guo, Yucan, et al.
Published: (2025)
LLM-Driven E-Commerce Marketing Content Optimization: Balancing Creativity and Conversion
by: Yang, Haowei, et al.
Published: (2025)
by: Yang, Haowei, et al.
Published: (2025)
Similar Items
-
ParallelSearch: Train your LLMs to Decompose Query and Search Sub-queries in Parallel with Reinforcement Learning
by: Zhao, Shu, et al.
Published: (2025) -
RAG-R1: Incentivizing the Search and Reasoning Capabilities of LLMs through Multi-query Parallelism
by: Tan, Zhiwen, et al.
Published: (2025) -
KU-DMIS at EHRSQL 2024:Generating SQL query via question templatization in EHR
by: Kim, Hajung, et al.
Published: (2024) -
FISHNET: Financial Intelligence from Sub-querying, Harmonizing, Neural-Conditioning, Expert Swarms, and Task Planning
by: Cho, Nicole, et al.
Published: (2024) -
Optimizing RAG Rerankers with LLM Feedback via Reinforcement Learning
by: Wu, Yuhang, et al.
Published: (2026)