Reinforcement Learning for Optimizing RAG for Domain Chatbots
Fuente:
arXiv
Saved in:
| Main Authors: | Kulkarni, Mandar, Tangarajan, Praveen, Kim, Kyung, Trivedi, Anusua |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Discrete Prompt Compression with Reinforcement Learning
by: Jung, Hoyoun, et al.
Published: (2023)
by: Jung, Hoyoun, et al.
Published: (2023)
Flippi: End To End GenAI Assistant for E-Commerce
by: Rajasekar, Anand A., et al.
Published: (2025)
by: Rajasekar, Anand A., et al.
Published: (2025)
How Reliable AI Chatbots are for Disease Prediction from Patient Complaints?
by: Nipu, Ayesha Siddika, et al.
Published: (2024)
by: Nipu, Ayesha Siddika, et al.
Published: (2024)
Efficient Learning for Product Attributes with Compact Multimodal Models
by: Kulkarni, Mandar
Published: (2025)
by: Kulkarni, Mandar
Published: (2025)
Advancing Risk and Quality Assurance: A RAG Chatbot for Improved Regulatory Compliance
by: Hillebrand, Lars, et al.
Published: (2025)
by: Hillebrand, Lars, et al.
Published: (2025)
Optimizing RAG Rerankers with LLM Feedback via Reinforcement Learning
by: Wu, Yuhang, et al.
Published: (2026)
by: Wu, Yuhang, et al.
Published: (2026)
Domain-Specific Improvement on Psychotherapy Chatbot Using Assistant
by: Kang, Cheng, et al.
Published: (2024)
by: Kang, Cheng, et al.
Published: (2024)
CTRL-RAG: Contrastive Likelihood Reward Based Reinforcement Learning for Context-Faithful RAG Models
by: Tan, Zhehao, et al.
Published: (2026)
by: Tan, Zhehao, et al.
Published: (2026)
UR$^2$: Unify RAG and Reasoning through Reinforcement Learning
by: Li, Weitao, et al.
Published: (2025)
by: Li, Weitao, et al.
Published: (2025)
A Hybrid Supervised-LLM Pipeline for Actionable Suggestion Mining in Unstructured Customer Reviews
by: Trivedi, Aakash, et al.
Published: (2026)
by: Trivedi, Aakash, et al.
Published: (2026)
CARE: A QLoRA-Fine Tuned Multi-Domain Chatbot With Fast Learning On Minimal Hardware
by: Dutta, Ankit, et al.
Published: (2025)
by: Dutta, Ankit, et al.
Published: (2025)
Efficient and Transferable Agentic Knowledge Graph RAG via Reinforcement Learning
by: Lin, Junhong, et al.
Published: (2025)
by: Lin, Junhong, et al.
Published: (2025)
RE-RAG: Improving Open-Domain QA Performance and Interpretability with Relevance Estimator in Retrieval-Augmented Generation
by: Kim, Kiseung, et al.
Published: (2024)
by: Kim, Kiseung, et al.
Published: (2024)
MENTOR: A Reinforcement Learning Framework for Enabling Tool Use in Small Models via Teacher-Optimized Rewards
by: Choi, ChangSu, et al.
Published: (2025)
by: Choi, ChangSu, et al.
Published: (2025)
IPCGRL: Language-Instructed Reinforcement Learning for Procedural Level Generation
by: Baek, In-Chang, et al.
Published: (2025)
by: Baek, In-Chang, et al.
Published: (2025)
RAFT: Adapting Language Model to Domain Specific RAG
by: Zhang, Tianjun, et al.
Published: (2024)
by: Zhang, Tianjun, et al.
Published: (2024)
Domain-Specific Data Generation Framework for RAG Adaptation
by: Tian, Chris Xing, et al.
Published: (2025)
by: Tian, Chris Xing, et al.
Published: (2025)
PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization
by: Wu, Jiayi, et al.
Published: (2024)
by: Wu, Jiayi, et al.
Published: (2024)
R3-RAG: Learning Step-by-Step Reasoning and Retrieval for LLMs via Reinforcement Learning
by: Li, Yuan, et al.
Published: (2025)
by: Li, Yuan, et al.
Published: (2025)
LLMs Position Themselves as More Rational Than Humans: Emergence of AI Self-Awareness Measured Through Game Theory
by: Kim, Kyung-Hoon
Published: (2025)
by: Kim, Kyung-Hoon
Published: (2025)
From Textbook to Talkbot: A Case Study of a Greek-Language RAG-Based Chatbot in Higher Education
by: Koutsiaki, Maria Eleni, et al.
Published: (2025)
by: Koutsiaki, Maria Eleni, et al.
Published: (2025)
Beyond Ontology in Dialogue State Tracking for Goal-Oriented Chatbot
by: Lee, Sejin, et al.
Published: (2024)
by: Lee, Sejin, et al.
Published: (2024)
Multi-Dimensional Optimization for Text Summarization via Reinforcement Learning
by: Ryu, Sangwon, et al.
Published: (2024)
by: Ryu, Sangwon, et al.
Published: (2024)
GlobalRAG: Enhancing Global Reasoning in Multi-hop Question Answering via Reinforcement Learning
by: Luo, Jinchang, et al.
Published: (2025)
by: Luo, Jinchang, et al.
Published: (2025)
AGENTiGraph: A Multi-Agent Knowledge Graph Framework for Interactive, Domain-Specific LLM Chatbots
by: Zhao, Xinjie, et al.
Published: (2025)
by: Zhao, Xinjie, et al.
Published: (2025)
RAGalyst: Automated Human-Aligned Agentic Evaluation for Domain-Specific RAG
by: Gao, Joshua, et al.
Published: (2025)
by: Gao, Joshua, et al.
Published: (2025)
RAG-BioQA: A Retrieval-Augmented Generation Framework for Long-Form Biomedical Question Answering
by: Panchumarthi, Lovely Yeswanth, et al.
Published: (2025)
by: Panchumarthi, Lovely Yeswanth, et al.
Published: (2025)
DynamicER: Resolving Emerging Mentions to Dynamic Entities for RAG
by: Kim, Jinyoung, et al.
Published: (2024)
by: Kim, Jinyoung, et al.
Published: (2024)
Relevance to Utility: Process-Supervised Rewrite for RAG
by: Kim, Jaeyoung, et al.
Published: (2025)
by: Kim, Jaeyoung, et al.
Published: (2025)
T-RAG: Lessons from the LLM Trenches
by: Fatehkia, Masoomali, et al.
Published: (2024)
by: Fatehkia, Masoomali, et al.
Published: (2024)
ProRAG: Process-Supervised Reinforcement Learning for Retrieval-Augmented Generation
by: Wang, Zhao, et al.
Published: (2026)
by: Wang, Zhao, et al.
Published: (2026)
Towards Optimizing and Evaluating a Retrieval Augmented QA Chatbot using LLMs with Human in the Loop
by: Afzal, Anum, et al.
Published: (2024)
by: Afzal, Anum, et al.
Published: (2024)
Tourism Question Answer System in Indian Language using Domain-Adapted Foundation Models
by: Gatla, Praveen, et al.
Published: (2025)
by: Gatla, Praveen, et al.
Published: (2025)
Chain-of-Rank: Enhancing Large Language Models for Domain-Specific RAG in Edge Device
by: Lee, Juntae, et al.
Published: (2025)
by: Lee, Juntae, et al.
Published: (2025)
Execution-Verified Reinforcement Learning for Optimization Modeling
by: Guan, Runda, et al.
Published: (2026)
by: Guan, Runda, et al.
Published: (2026)
Beyond Text: Optimizing RAG with Multimodal Inputs for Industrial Applications
by: Riedler, Monica, et al.
Published: (2024)
by: Riedler, Monica, et al.
Published: (2024)
When RAG Chatbots Expose Their Backend: An Anonymized Case Study of Privacy and Security Risks in Patient-Facing Medical AI
by: Madrid-García, Alfredo, et al.
Published: (2026)
by: Madrid-García, Alfredo, et al.
Published: (2026)
Quality-Aware Translation Tagging in Multilingual RAG system
by: Moon, Hoyeon, et al.
Published: (2025)
by: Moon, Hoyeon, et al.
Published: (2025)
ChatEL: Entity Linking with Chatbots
by: Ding, Yifan, et al.
Published: (2024)
by: Ding, Yifan, et al.
Published: (2024)
Are Chatbots Reliable Text Annotators? Sometimes
by: Kristensen-McLachlan, Ross Deans, et al.
Published: (2023)
by: Kristensen-McLachlan, Ross Deans, et al.
Published: (2023)
Similar Items
-
Discrete Prompt Compression with Reinforcement Learning
by: Jung, Hoyoun, et al.
Published: (2023) -
Flippi: End To End GenAI Assistant for E-Commerce
by: Rajasekar, Anand A., et al.
Published: (2025) -
How Reliable AI Chatbots are for Disease Prediction from Patient Complaints?
by: Nipu, Ayesha Siddika, et al.
Published: (2024) -
Efficient Learning for Product Attributes with Compact Multimodal Models
by: Kulkarni, Mandar
Published: (2025) -
Advancing Risk and Quality Assurance: A RAG Chatbot for Improved Regulatory Compliance
by: Hillebrand, Lars, et al.
Published: (2025)