Training LLMs with Reinforcement Learning for Intent-Aware Personalized Question Answering
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Amirizaniani, Maryam, Lee, Benjamin Charles Germain, West, Jevin, Weber, Nicholas |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Learning to Reason for Multi-Step Retrieval of Personal Context in Personalized Question Answering
par: Amirizaniani, Maryam, et autres
Publié: (2026)
par: Amirizaniani, Maryam, et autres
Publié: (2026)
IPQA: A Benchmark for Core Intent Identification in Personalized Question Answering
par: Kim, Jieyong, et autres
Publié: (2025)
par: Kim, Jieyong, et autres
Publié: (2025)
Response: Emergent analogical reasoning in large language models
par: Hodel, Damian, et autres
Publié: (2023)
par: Hodel, Damian, et autres
Publié: (2023)
Improving Attributed Long-form Question Answering with Intent Awareness
par: Zhao, Xinran, et autres
Publié: (2026)
par: Zhao, Xinran, et autres
Publié: (2026)
Do LLMs Exhibit Human-Like Reasoning? Evaluating Theory of Mind in LLMs for Open-Ended Responses
par: Amirizaniani, Maryam, et autres
Publié: (2024)
par: Amirizaniani, Maryam, et autres
Publié: (2024)
Intent Aware Context Retrieval for Multi-Turn Agricultural Question Answering
par: Vijayvargia, Abhay, et autres
Publié: (2025)
par: Vijayvargia, Abhay, et autres
Publié: (2025)
A$^2$Search: Ambiguity-Aware Question Answering with Reinforcement Learning
par: Zhang, Fengji, et autres
Publié: (2025)
par: Zhang, Fengji, et autres
Publié: (2025)
Reinforcement Learning for Conversational Question Answering over Knowledge Graph
par: Wu, Mi
Publié: (2024)
par: Wu, Mi
Publié: (2024)
QPaug: Question and Passage Augmentation for Open-Domain Question Answering of LLMs
par: Kim, Minsang, et autres
Publié: (2024)
par: Kim, Minsang, et autres
Publié: (2024)
Question Answering with LLMs and Learning from Answer Sets
par: Borroto, Manuel, et autres
Publié: (2025)
par: Borroto, Manuel, et autres
Publié: (2025)
Robust Training for Conversational Question Answering Models with Reinforced Reformulation Generation
par: Kaiser, Magdalena, et autres
Publié: (2023)
par: Kaiser, Magdalena, et autres
Publié: (2023)
Automatic Evaluation of Healthcare LLMs Beyond Question-Answering
par: Arias-Duart, Anna, et autres
Publié: (2025)
par: Arias-Duart, Anna, et autres
Publié: (2025)
Learning from Natural Language Feedback for Personalized Question Answering
par: Salemi, Alireza, et autres
Publié: (2025)
par: Salemi, Alireza, et autres
Publié: (2025)
Structural Deep Encoding for Table Question Answering
par: Mouravieff, Raphaël, et autres
Publié: (2025)
par: Mouravieff, Raphaël, et autres
Publié: (2025)
Fine-Tuning LLMs for Reliable Medical Question-Answering Services
par: Anaissi, Ali, et autres
Publié: (2024)
par: Anaissi, Ali, et autres
Publié: (2024)
Knowledgeable Preference Alignment for LLMs in Domain-specific Question Answering
par: Zhang, Yichi, et autres
Publié: (2023)
par: Zhang, Yichi, et autres
Publié: (2023)
Uncertainty-Aware Dynamic Knowledge Graphs for Reliable Question Answering
par: Takahashi, Yu, et autres
Publié: (2025)
par: Takahashi, Yu, et autres
Publié: (2025)
A Survey of the State-of-the-Art in Conversational Question Answering Systems
par: Perera, Manoj Madushanka, et autres
Publié: (2025)
par: Perera, Manoj Madushanka, et autres
Publié: (2025)
Augmenting Black-box LLMs with Medical Textbooks for Biomedical Question Answering
par: Wang, Yubo, et autres
Publié: (2023)
par: Wang, Yubo, et autres
Publié: (2023)
Question Answering on Patient Medical Records with Private Fine-Tuned LLMs
par: Kothari, Sara, et autres
Publié: (2025)
par: Kothari, Sara, et autres
Publié: (2025)
Hybrid Graphs for Table-and-Text based Question Answering using LLMs
par: Agarwal, Ankush, et autres
Publié: (2025)
par: Agarwal, Ankush, et autres
Publié: (2025)
60 Data Points are Sufficient to Fine-Tune LLMs for Question-Answering
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
GlobalRAG: Enhancing Global Reasoning in Multi-hop Question Answering via Reinforcement Learning
par: Luo, Jinchang, et autres
Publié: (2025)
par: Luo, Jinchang, et autres
Publié: (2025)
KoBBQ: Korean Bias Benchmark for Question Answering
par: Jin, Jiho, et autres
Publié: (2023)
par: Jin, Jiho, et autres
Publié: (2023)
Towards Robust Extractive Question Answering Models: Rethinking the Training Methodology
par: Tran, Son Quoc, et autres
Publié: (2024)
par: Tran, Son Quoc, et autres
Publié: (2024)
RPO-RAG: Aligning Small LLMs with Relation-aware Preference Optimization for Knowledge Graph Question Answering
par: Um, Kaehyun, et autres
Publié: (2026)
par: Um, Kaehyun, et autres
Publié: (2026)
Mind the Ambiguity: Aleatoric Uncertainty Quantification in LLMs for Safe Medical Question Answering
par: Liu, Yaokun, et autres
Publié: (2026)
par: Liu, Yaokun, et autres
Publié: (2026)
I've got the "Answer"! Interpretation of LLMs Hidden States in Question Answering
par: Goloviznina, Valeriya, et autres
Publié: (2024)
par: Goloviznina, Valeriya, et autres
Publié: (2024)
Generative Data Augmentation using LLMs improves Distributional Robustness in Question Answering
par: Chowdhury, Arijit Ghosh, et autres
Publié: (2023)
par: Chowdhury, Arijit Ghosh, et autres
Publié: (2023)
Evaluating Correctness and Faithfulness of Instruction-Following Models for Question Answering
par: Adlakha, Vaibhav, et autres
Publié: (2023)
par: Adlakha, Vaibhav, et autres
Publié: (2023)
Denoising Table-Text Retrieval for Open-Domain Question Answering
par: Kang, Deokhyung, et autres
Publié: (2024)
par: Kang, Deokhyung, et autres
Publié: (2024)
Piece of Table: A Divide-and-Conquer Approach for Selecting Subtables in Table Question Answering
par: Lee, Wonjin, et autres
Publié: (2024)
par: Lee, Wonjin, et autres
Publié: (2024)
Augmenting Multimodal LLMs with Self-Reflective Tokens for Knowledge-based Visual Question Answering
par: Cocchi, Federico, et autres
Publié: (2024)
par: Cocchi, Federico, et autres
Publié: (2024)
Temporal-Aware Heterogeneous Graph Reasoning with Multi-View Fusion for Temporal Question Answering
par: Wen, Wuzhenghong, et autres
Publié: (2026)
par: Wen, Wuzhenghong, et autres
Publié: (2026)
Memory-Augmented Knowledge Fusion with Safety-Aware Decoding for Domain-Adaptive Question Answering
par: Fu, Lei, et autres
Publié: (2025)
par: Fu, Lei, et autres
Publié: (2025)
OLAPH: Improving Factuality in Biomedical Long-form Question Answering
par: Jeong, Minbyul, et autres
Publié: (2024)
par: Jeong, Minbyul, et autres
Publié: (2024)
PRISM: Agentic Retrieval with LLMs for Multi-Hop Question Answering
par: Nahid, Md Mahadi Hasan, et autres
Publié: (2025)
par: Nahid, Md Mahadi Hasan, et autres
Publié: (2025)
Graph Neural Network Enhanced Retrieval for Question Answering of LLMs
par: Li, Zijian, et autres
Publié: (2024)
par: Li, Zijian, et autres
Publié: (2024)
Evaluating Consistencies in LLM responses through a Semantic Clustering of Question Answering
par: Lee, Yanggyu, et autres
Publié: (2024)
par: Lee, Yanggyu, et autres
Publié: (2024)
Black-box Model Ensembling for Textual and Visual Question Answering via Information Fusion
par: Xia, Yuxi, et autres
Publié: (2024)
par: Xia, Yuxi, et autres
Publié: (2024)
Documents similaires
-
Learning to Reason for Multi-Step Retrieval of Personal Context in Personalized Question Answering
par: Amirizaniani, Maryam, et autres
Publié: (2026) -
IPQA: A Benchmark for Core Intent Identification in Personalized Question Answering
par: Kim, Jieyong, et autres
Publié: (2025) -
Response: Emergent analogical reasoning in large language models
par: Hodel, Damian, et autres
Publié: (2023) -
Improving Attributed Long-form Question Answering with Intent Awareness
par: Zhao, Xinran, et autres
Publié: (2026) -
Do LLMs Exhibit Human-Like Reasoning? Evaluating Theory of Mind in LLMs for Open-Ended Responses
par: Amirizaniani, Maryam, et autres
Publié: (2024)