Towards Faithful and Robust LLM Specialists for Evidence-Based Question-Answering
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Schimanski, Tobias, Ni, Jingwei, Kraus, Mathias, Ash, Elliott, Leippold, Markus |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
pdfQA: Diverse, Challenging, and Realistic Question Answering over PDFs
par: Schimanski, Tobias, et autres
Publié: (2026)
par: Schimanski, Tobias, et autres
Publié: (2026)
DIRAS: Efficient LLM Annotation of Document Relevance in Retrieval Augmented Generation
par: Ni, Jingwei, et autres
Publié: (2024)
par: Ni, Jingwei, et autres
Publié: (2024)
AFaCTA: Assisting the Annotation of Factual Claim Detection with Reliable LLM Annotators
par: Ni, Jingwei, et autres
Publié: (2024)
par: Ni, Jingwei, et autres
Publié: (2024)
Exploring Nature: Datasets and Models for Analyzing Nature-Related Disclosures
par: Schimanski, Tobias, et autres
Publié: (2023)
par: Schimanski, Tobias, et autres
Publié: (2023)
Who's Asking? Evaluating LLM Robustness to Inquiry Personas in Factual Question Answering
par: Akpinar, Nil-Jana, et autres
Publié: (2025)
par: Akpinar, Nil-Jana, et autres
Publié: (2025)
Interpretable LLM-based Table Question Answering
par: Nguyen, Giang, et autres
Publié: (2024)
par: Nguyen, Giang, et autres
Publié: (2024)
CRAFT: Calibrated Reasoning with Answer-Faithful Traces via Reinforcement Learning for Multi-Hop Question Answering
par: Liu, Yu, et autres
Publié: (2026)
par: Liu, Yu, et autres
Publié: (2026)
Balancing Truthfulness and Informativeness with Uncertainty-Aware Instruction Fine-Tuning
par: Wu, Tianyi, et autres
Publié: (2025)
par: Wu, Tianyi, et autres
Publié: (2025)
UsefulBench: Towards Decision-Useful Information as a Target for Information Retrieval
par: Schimanski, Tobias, et autres
Publié: (2026)
par: Schimanski, Tobias, et autres
Publié: (2026)
Tools in the Loop: Quantifying Uncertainty of LLM Question Answering Systems That Use Tools
par: Lymperopoulos, Panagiotis, et autres
Publié: (2025)
par: Lymperopoulos, Panagiotis, et autres
Publié: (2025)
Can Reasoning Help Large Language Models Capture Human Annotator Disagreement?
par: Ni, Jingwei, et autres
Publié: (2025)
par: Ni, Jingwei, et autres
Publié: (2025)
ESQA: Event Sequences Question Answering
par: Abdullaeva, Irina, et autres
Publié: (2024)
par: Abdullaeva, Irina, et autres
Publié: (2024)
Structured RAG for Answering Aggregative Questions
par: Koshorek, Omri, et autres
Publié: (2025)
par: Koshorek, Omri, et autres
Publié: (2025)
On Mechanistic Circuits for Extractive Question-Answering
par: Basu, Samyadeep, et autres
Publié: (2025)
par: Basu, Samyadeep, et autres
Publié: (2025)
On the Calibration of Multilingual Question Answering LLMs
par: Yang, Yahan, et autres
Publié: (2023)
par: Yang, Yahan, et autres
Publié: (2023)
Are LLM Decisions Faithful to Verbal Confidence?
par: Wang, Jiawei, et autres
Publié: (2026)
par: Wang, Jiawei, et autres
Publié: (2026)
Deceiving Question-Answering Models: A Hybrid Word-Level Adversarial Approach
par: Li, Jiyao, et autres
Publié: (2024)
par: Li, Jiyao, et autres
Publié: (2024)
Neural at ArchEHR-QA 2025: Agentic Prompt Optimization for Evidence-Grounded Clinical Question Answering
par: Bogireddy, Sai Prasanna Teja Reddy, et autres
Publié: (2025)
par: Bogireddy, Sai Prasanna Teja Reddy, et autres
Publié: (2025)
Towards Unsupervised Question Answering System with Multi-level Summarization for Legal Text
par: Prabhu, M Manvith, et autres
Publié: (2024)
par: Prabhu, M Manvith, et autres
Publié: (2024)
Explainable Fact-checking through Question Answering
par: Yang, Jing, et autres
Publié: (2021)
par: Yang, Jing, et autres
Publié: (2021)
Faithful and Robust Local Interpretability for Textual Predictions
par: Lopardo, Gianluigi, et autres
Publié: (2023)
par: Lopardo, Gianluigi, et autres
Publié: (2023)
Variational Best-of-N Alignment
par: Amini, Afra, et autres
Publié: (2024)
par: Amini, Afra, et autres
Publié: (2024)
Evidence-Focused Fact Summarization for Knowledge-Augmented Zero-Shot Question Answering
par: Ko, Sungho, et autres
Publié: (2024)
par: Ko, Sungho, et autres
Publié: (2024)
Q-NL Verifier: Leveraging Synthetic Data for Robust Knowledge Graph Question Answering
par: Schwabe, Tim, et autres
Publié: (2025)
par: Schwabe, Tim, et autres
Publié: (2025)
LEXam: Benchmarking Legal Reasoning on 340 Law Exams
par: Fan, Yu, et autres
Publié: (2025)
par: Fan, Yu, et autres
Publié: (2025)
Listen to the Context: Towards Faithful Large Language Models for Retrieval Augmented Generation on Climate Questions
par: Thulke, David, et autres
Publié: (2025)
par: Thulke, David, et autres
Publié: (2025)
HealthNLP_Retrievers at ArchEHR-QA 2026: Cascaded LLM Pipeline for Grounded Clinical Question Answering
par: Hosen, Md Biplob, et autres
Publié: (2026)
par: Hosen, Md Biplob, et autres
Publié: (2026)
Calibrated Large Language Models for Binary Question Answering
par: Giovannotti, Patrizio, et autres
Publié: (2024)
par: Giovannotti, Patrizio, et autres
Publié: (2024)
OWLViz: An Open-World Benchmark for Visual Question Answering
par: Nguyen, Thuy, et autres
Publié: (2025)
par: Nguyen, Thuy, et autres
Publié: (2025)
FoQA: A Faroese Question-Answering Dataset
par: Simonsen, Annika, et autres
Publié: (2025)
par: Simonsen, Annika, et autres
Publié: (2025)
LinkQ: An LLM-Assisted Visual Interface for Knowledge Graph Question-Answering
par: Li, Harry, et autres
Publié: (2024)
par: Li, Harry, et autres
Publié: (2024)
FaithLM: Towards Faithful Explanations for Large Language Models
par: Chuang, Yu-Neng, et autres
Publié: (2024)
par: Chuang, Yu-Neng, et autres
Publié: (2024)
Language Model Knowledge Distillation for Efficient Question Answering in Spanish
par: Bazaga, Adrián, et autres
Publié: (2023)
par: Bazaga, Adrián, et autres
Publié: (2023)
DRESSing Up LLM: Efficient Stylized Question-Answering via Style Subspace Editing
par: Ma, Xinyu, et autres
Publié: (2025)
par: Ma, Xinyu, et autres
Publié: (2025)
Interpretable Question Answering with Knowledge Graphs
par: Aneja, Kartikeya, et autres
Publié: (2025)
par: Aneja, Kartikeya, et autres
Publié: (2025)
Transformer Circuit Faithfulness Metrics are not Robust
par: Miller, Joseph, et autres
Publié: (2024)
par: Miller, Joseph, et autres
Publié: (2024)
MedFuzz: Exploring the Robustness of Large Language Models in Medical Question Answering
par: Ness, Robert Osazuwa, et autres
Publié: (2024)
par: Ness, Robert Osazuwa, et autres
Publié: (2024)
MahaSQuAD: Bridging Linguistic Divides in Marathi Question-Answering
par: Ghatage, Ruturaj, et autres
Publié: (2024)
par: Ghatage, Ruturaj, et autres
Publié: (2024)
Robust Infidelity: When Faithfulness Measures on Masked Language Models Are Misleading
par: Crothers, Evan, et autres
Publié: (2023)
par: Crothers, Evan, et autres
Publié: (2023)
Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM
par: Nachmani, Eliya, et autres
Publié: (2023)
par: Nachmani, Eliya, et autres
Publié: (2023)
Documents similaires
-
pdfQA: Diverse, Challenging, and Realistic Question Answering over PDFs
par: Schimanski, Tobias, et autres
Publié: (2026) -
DIRAS: Efficient LLM Annotation of Document Relevance in Retrieval Augmented Generation
par: Ni, Jingwei, et autres
Publié: (2024) -
AFaCTA: Assisting the Annotation of Factual Claim Detection with Reliable LLM Annotators
par: Ni, Jingwei, et autres
Publié: (2024) -
Exploring Nature: Datasets and Models for Analyzing Nature-Related Disclosures
par: Schimanski, Tobias, et autres
Publié: (2023) -
Who's Asking? Evaluating LLM Robustness to Inquiry Personas in Factual Question Answering
par: Akpinar, Nil-Jana, et autres
Publié: (2025)