Learning to Extract Rational Evidence via Reinforcement Learning for Retrieval-Augmented Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Xinping, Huang, Shouzheng, Zhong, Yan, Hu, Xinshuo, Zhang, Meishan, Hu, Baotian, Zhang, Min |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ToolOmni: Enabling Open-World Tool Use via Agentic learning with Proactive Retrieval and Grounded Execution
par: Huang, Shouzheng, et autres
Publié: (2026)
par: Huang, Shouzheng, et autres
Publié: (2026)
On The Role of Pretrained Language Models in General-Purpose Text Embeddings: A Survey
par: Zhang, Meishan, et autres
Publié: (2025)
par: Zhang, Meishan, et autres
Publié: (2025)
SEER: Self-Aligned Evidence Extraction for Retrieval-Augmented Generation
par: Zhao, Xinping, et autres
Publié: (2024)
par: Zhao, Xinping, et autres
Publié: (2024)
FunnelRAG: A Coarse-to-Fine Progressive Retrieval Paradigm for RAG
par: Zhao, Xinping, et autres
Publié: (2024)
par: Zhao, Xinping, et autres
Publié: (2024)
Take Off the Training Wheels Progressive In-Context Learning for Effective Alignment
par: Liu, Zhenyu, et autres
Publié: (2025)
par: Liu, Zhenyu, et autres
Publié: (2025)
Dynamic Long Context Reasoning over Compressed Memory via End-to-End Reinforcement Learning
par: Chen, Zhuoen, et autres
Publié: (2026)
par: Chen, Zhuoen, et autres
Publié: (2026)
LMEB: Long-horizon Memory Embedding Benchmark
par: Zhao, Xinping, et autres
Publié: (2026)
par: Zhao, Xinping, et autres
Publié: (2026)
CMT: A Memory Compression Method for Continual Knowledge Learning of Large Language Models
par: Li, Dongfang, et autres
Publié: (2024)
par: Li, Dongfang, et autres
Publié: (2024)
Improving Attributed Text Generation of Large Language Models via Preference Learning
par: Li, Dongfang, et autres
Publié: (2024)
par: Li, Dongfang, et autres
Publié: (2024)
In-Context Learning State Vector with Inner and Momentum Optimization
par: Li, Dongfang, et autres
Publié: (2024)
par: Li, Dongfang, et autres
Publié: (2024)
KaLM-Embedding-V2: Superior Training Techniques and Data Inspire A Versatile Embedding Model
par: Zhao, Xinping, et autres
Publié: (2025)
par: Zhao, Xinping, et autres
Publié: (2025)
Separate the Wheat from the Chaff: Model Deficiency Unlearning via Parameter-Efficient Module Operation
par: Hu, Xinshuo, et autres
Publié: (2023)
par: Hu, Xinshuo, et autres
Publié: (2023)
Does the Generator Mind its Contexts? An Analysis of Generative Model Faithfulness under Context Transfer
par: Hu, Xinshuo, et autres
Publié: (2024)
par: Hu, Xinshuo, et autres
Publié: (2024)
Beyond Chunking: Discourse-Aware Hierarchical Retrieval for Long Document Question Answering
par: Chen, Huiyao, et autres
Publié: (2025)
par: Chen, Huiyao, et autres
Publié: (2025)
RaSeRec: Retrieval-Augmented Sequential Recommendation
par: Zhao, Xinping, et autres
Publié: (2024)
par: Zhao, Xinping, et autres
Publié: (2024)
Medico: Towards Hallucination Detection and Correction with Multi-source Evidence Fusion
par: Zhao, Xinping, et autres
Publié: (2024)
par: Zhao, Xinping, et autres
Publié: (2024)
Generative Multimodal Entity Linking
par: Shi, Senbao, et autres
Publié: (2023)
par: Shi, Senbao, et autres
Publié: (2023)
KaLM-Embedding: Superior Training Data Brings A Stronger Embedding Model
par: Hu, Xinshuo, et autres
Publié: (2025)
par: Hu, Xinshuo, et autres
Publié: (2025)
Retrieval-style In-Context Learning for Few-shot Hierarchical Text Classification
par: Chen, Huiyao, et autres
Publié: (2024)
par: Chen, Huiyao, et autres
Publié: (2024)
Language-Coupled Reinforcement Learning for Multilingual Retrieval-Augmented Generation
par: Qi, Rui, et autres
Publié: (2026)
par: Qi, Rui, et autres
Publié: (2026)
Contrastive Learning on LLM Back Generation Treebank for Cross-domain Constituency Parsing
par: Guo, Peiming, et autres
Publié: (2025)
par: Guo, Peiming, et autres
Publié: (2025)
Less Languages, Less Tokens: An Efficient Unified Logic Cross-lingual Chain-of-Thought Reasoning Framework
par: Zhang, Chenyuan, et autres
Publié: (2026)
par: Zhang, Chenyuan, et autres
Publié: (2026)
Improving Value-based Process Verifier via Low-Cost Variance Reduction
par: Sun, Zetian, et autres
Publié: (2025)
par: Sun, Zetian, et autres
Publié: (2025)
In-Context Learning for Few-Shot Nested Named Entity Recognition
par: Zhang, Meishan, et autres
Publié: (2024)
par: Zhang, Meishan, et autres
Publié: (2024)
Trustworthy Alignment of Retrieval-Augmented Large Language Models via Reinforcement Learning
par: Zhang, Zongmeng, et autres
Publié: (2024)
par: Zhang, Zongmeng, et autres
Publié: (2024)
Improving Retrieval-Augmented Generation through Multi-Agent Reinforcement Learning
par: Chen, Yiqun, et autres
Publié: (2025)
par: Chen, Yiqun, et autres
Publié: (2025)
Temporal Knowledge Question Answering via Abstract Reasoning Induction
par: Chen, Ziyang, et autres
Publié: (2023)
par: Chen, Ziyang, et autres
Publié: (2023)
RAG-RL: Advancing Retrieval-Augmented Generation via RL and Curriculum Learning
par: Huang, Jerry, et autres
Publié: (2025)
par: Huang, Jerry, et autres
Publié: (2025)
ProRAG: Process-Supervised Reinforcement Learning for Retrieval-Augmented Generation
par: Wang, Zhao, et autres
Publié: (2026)
par: Wang, Zhao, et autres
Publié: (2026)
Detecting Hallucinations in Retrieval-Augmented Generation via Semantic-level Internal Reasoning Graph
par: Hu, Jianpeng, et autres
Publié: (2026)
par: Hu, Jianpeng, et autres
Publié: (2026)
Stabilizing Long-term Multi-turn Reinforcement Learning with Gated Rewards
par: Sun, Zetian, et autres
Publié: (2025)
par: Sun, Zetian, et autres
Publié: (2025)
Utility-Oriented Visual Evidence Selection for Multimodal Retrieval-Augmented Generation
par: Luo, Weiqing, et autres
Publié: (2026)
par: Luo, Weiqing, et autres
Publié: (2026)
DACL-RAG: Data Augmentation Strategy with Curriculum Learning for Retrieval-Augmented Generation
par: Wang, Shaohan, et autres
Publié: (2025)
par: Wang, Shaohan, et autres
Publié: (2025)
DecEx-RAG: Boosting Agentic Retrieval-Augmented Generation with Decision and Execution Optimization via Process Supervision
par: Leng, Yongqi, et autres
Publié: (2025)
par: Leng, Yongqi, et autres
Publié: (2025)
Improving Value-based Process Verifier via Structural Prior Injection
par: Sun, Zetian, et autres
Publié: (2025)
par: Sun, Zetian, et autres
Publié: (2025)
RAGRouter: Learning to Route Queries to Multiple Retrieval-Augmented Language Models
par: Zhang, Jiarui, et autres
Publié: (2025)
par: Zhang, Jiarui, et autres
Publié: (2025)
Privacy-Preserving Federated Embedding Learning for Localized Retrieval-Augmented Generation
par: Mao, Qianren, et autres
Publié: (2025)
par: Mao, Qianren, et autres
Publié: (2025)
Med-R$^3$: Enhancing Medical Retrieval-Augmented Reasoning of LLMs via Progressive Reinforcement Learning
par: Lu, Keer, et autres
Publié: (2025)
par: Lu, Keer, et autres
Publié: (2025)
A Multimodal In-Context Tuning Approach for E-Commerce Product Description Generation
par: Li, Yunxin, et autres
Publié: (2024)
par: Li, Yunxin, et autres
Publié: (2024)
Retrieval Augmented Generation Evaluation in the Era of Large Language Models: A Comprehensive Survey
par: Gan, Aoran, et autres
Publié: (2025)
par: Gan, Aoran, et autres
Publié: (2025)
Documents similaires
-
ToolOmni: Enabling Open-World Tool Use via Agentic learning with Proactive Retrieval and Grounded Execution
par: Huang, Shouzheng, et autres
Publié: (2026) -
On The Role of Pretrained Language Models in General-Purpose Text Embeddings: A Survey
par: Zhang, Meishan, et autres
Publié: (2025) -
SEER: Self-Aligned Evidence Extraction for Retrieval-Augmented Generation
par: Zhao, Xinping, et autres
Publié: (2024) -
FunnelRAG: A Coarse-to-Fine Progressive Retrieval Paradigm for RAG
par: Zhao, Xinping, et autres
Publié: (2024) -
Take Off the Training Wheels Progressive In-Context Learning for Effective Alignment
par: Liu, Zhenyu, et autres
Publié: (2025)