Quantifying Uncertainty in Natural Language Explanations of Large Language Models for Question Answering
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Yangyi, Huai, Mengdi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Uncertainty-aware Language Guidance for Concept Bottleneck Models
par: Li, Yangyi, et autres
Publié: (2026)
par: Li, Yangyi, et autres
Publié: (2026)
Quantifying and Understanding Uncertainty in Large Reasoning Models
par: Li, Yangyi, et autres
Publié: (2026)
par: Li, Yangyi, et autres
Publié: (2026)
Benchmarking Uncertainty Calibration in Large Language Model Long-Form Question Answering
par: Müller, Philip, et autres
Publié: (2026)
par: Müller, Philip, et autres
Publié: (2026)
Calibrated Large Language Models for Binary Question Answering
par: Giovannotti, Patrizio, et autres
Publié: (2024)
par: Giovannotti, Patrizio, et autres
Publié: (2024)
Question Rephrasing for Quantifying Uncertainty in Large Language Models: Applications in Molecular Chemistry Tasks
par: Chen, Zizhang, et autres
Publié: (2024)
par: Chen, Zizhang, et autres
Publié: (2024)
Tools in the Loop: Quantifying Uncertainty of LLM Question Answering Systems That Use Tools
par: Lymperopoulos, Panagiotis, et autres
Publié: (2025)
par: Lymperopoulos, Panagiotis, et autres
Publié: (2025)
Towards Benchmarking Privacy Vulnerabilities in Selective Forgetting with Large Language Models
par: Qian, Wei, et autres
Publié: (2025)
par: Qian, Wei, et autres
Publié: (2025)
DRESS: Instructing Large Vision-Language Models to Align and Interact with Humans via Natural Language Feedback
par: Chen, Yangyi, et autres
Publié: (2023)
par: Chen, Yangyi, et autres
Publié: (2023)
Reasoning-Grounded Natural Language Explanations for Language Models
par: Cahlik, Vojtech, et autres
Publié: (2025)
par: Cahlik, Vojtech, et autres
Publié: (2025)
Spatially Grounded Explanations in Vision Language Models for Document Visual Question Answering
par: Lagos, Maximiliano Hormazábal, et autres
Publié: (2025)
par: Lagos, Maximiliano Hormazábal, et autres
Publié: (2025)
Dynamic Strategy Planning for Efficient Question Answering with Large Language Models
par: Parekh, Tanmay, et autres
Publié: (2024)
par: Parekh, Tanmay, et autres
Publié: (2024)
MEG: Medical Knowledge-Augmented Large Language Models for Question Answering
par: Cabello, Laura, et autres
Publié: (2024)
par: Cabello, Laura, et autres
Publié: (2024)
Language Model Knowledge Distillation for Efficient Question Answering in Spanish
par: Bazaga, Adrián, et autres
Publié: (2023)
par: Bazaga, Adrián, et autres
Publié: (2023)
FacLens: Transferable Probe for Foreseeing Non-Factuality in Fact-Seeking Question Answering of Large Language Models
par: Wang, Yanling, et autres
Publié: (2024)
par: Wang, Yanling, et autres
Publié: (2024)
A Study on Large Language Models' Limitations in Multiple-Choice Question Answering
par: Khatun, Aisha, et autres
Publié: (2024)
par: Khatun, Aisha, et autres
Publié: (2024)
Don't Just Say "I don't know"! Self-aligning Large Language Models for Responding to Unknown Questions with Explanations
par: Deng, Yang, et autres
Publié: (2024)
par: Deng, Yang, et autres
Publié: (2024)
A Large-Scale Benchmark for Evaluating Large Language Models on Medical Question Answering in Romanian
par: Rogoz, Ana-Cristina, et autres
Publié: (2025)
par: Rogoz, Ana-Cristina, et autres
Publié: (2025)
Examining LLMs' Uncertainty Expression Towards Questions Outside Parametric Knowledge
par: Liu, Genglin, et autres
Publié: (2023)
par: Liu, Genglin, et autres
Publié: (2023)
Assessing Modality Bias in Video Question Answering Benchmarks with Multimodal Large Language Models
par: Park, Jean, et autres
Publié: (2024)
par: Park, Jean, et autres
Publié: (2024)
Uncertainty as Feature Gaps: Epistemic Uncertainty Quantification of LLMs in Contextual Question-Answering
par: Bakman, Yavuz, et autres
Publié: (2025)
par: Bakman, Yavuz, et autres
Publié: (2025)
MedFuzz: Exploring the Robustness of Large Language Models in Medical Question Answering
par: Ness, Robert Osazuwa, et autres
Publié: (2024)
par: Ness, Robert Osazuwa, et autres
Publié: (2024)
SQuARE: Sequential Question Answering Reasoning Engine for Enhanced Chain-of-Thought in Large Language Models
par: Fleischer, Daniel, et autres
Publié: (2025)
par: Fleischer, Daniel, et autres
Publié: (2025)
MapIQ: Evaluating Multimodal Large Language Models for Map Question Answering
par: Srivastava, Varun, et autres
Publié: (2025)
par: Srivastava, Varun, et autres
Publié: (2025)
MedLM: Exploring Language Models for Medical Question Answering Systems
par: Yagnik, Niraj, et autres
Publié: (2024)
par: Yagnik, Niraj, et autres
Publié: (2024)
Fine-Tuning Large Language Models and Evaluating Retrieval Methods for Improved Question Answering on Building Codes
par: Aqib, Mohammad, et autres
Publié: (2025)
par: Aqib, Mohammad, et autres
Publié: (2025)
Question-Aware Knowledge Graph Prompting for Enhancing Large Language Models
par: Liu, Haochen, et autres
Publié: (2025)
par: Liu, Haochen, et autres
Publié: (2025)
Query Performance Explanation through Large Language Model for HTAP Systems
par: Xiu, Haibo, et autres
Publié: (2024)
par: Xiu, Haibo, et autres
Publié: (2024)
FLEx: Language Modeling with Few-shot Language Explanations
par: Avsian, Adar, et autres
Publié: (2026)
par: Avsian, Adar, et autres
Publié: (2026)
Prophet: Prompting Large Language Models with Complementary Answer Heuristics for Knowledge-based Visual Question Answering
par: Yu, Zhou, et autres
Publié: (2023)
par: Yu, Zhou, et autres
Publié: (2023)
Towards Consistent Natural-Language Explanations via Explanation-Consistency Finetuning
par: Chen, Yanda, et autres
Publié: (2024)
par: Chen, Yanda, et autres
Publié: (2024)
Retrieval-enhanced Knowledge Editing in Language Models for Multi-Hop Question Answering
par: Shi, Yucheng, et autres
Publié: (2024)
par: Shi, Yucheng, et autres
Publié: (2024)
Cross-Refine: Improving Natural Language Explanation Generation by Learning in Tandem
par: Wang, Qianli, et autres
Publié: (2024)
par: Wang, Qianli, et autres
Publié: (2024)
Prompting Medical Large Vision-Language Models to Diagnose Pathologies by Visual Question Answering
par: Guo, Danfeng, et autres
Publié: (2024)
par: Guo, Danfeng, et autres
Publié: (2024)
Quantifying the Impact of Structured Output Format on Large Language Models through Causal Inference
par: Yuan, Han, et autres
Publié: (2025)
par: Yuan, Han, et autres
Publié: (2025)
Uncertainty Quantification for In-Context Learning of Large Language Models
par: Ling, Chen, et autres
Publié: (2024)
par: Ling, Chen, et autres
Publié: (2024)
Benchmarking Large Language Model Uncertainty for Prompt Optimization
par: Guo, Pei-Fu, et autres
Publié: (2024)
par: Guo, Pei-Fu, et autres
Publié: (2024)
IndicSQuAD: A Comprehensive Multilingual Question Answering Dataset for Indic Languages
par: Endait, Sharvi, et autres
Publié: (2025)
par: Endait, Sharvi, et autres
Publié: (2025)
On Uncertainty In Natural Language Processing
par: Ulmer, Dennis
Publié: (2024)
par: Ulmer, Dennis
Publié: (2024)
Decoding Uncertainty: The Impact of Decoding Strategies for Uncertainty Estimation in Large Language Models
par: Hashimoto, Wataru, et autres
Publié: (2025)
par: Hashimoto, Wataru, et autres
Publié: (2025)
Towards Unveiling Predictive Uncertainty Vulnerabilities in the Context of the Right to Be Forgotten
par: Qian, Wei, et autres
Publié: (2025)
par: Qian, Wei, et autres
Publié: (2025)
Documents similaires
-
Uncertainty-aware Language Guidance for Concept Bottleneck Models
par: Li, Yangyi, et autres
Publié: (2026) -
Quantifying and Understanding Uncertainty in Large Reasoning Models
par: Li, Yangyi, et autres
Publié: (2026) -
Benchmarking Uncertainty Calibration in Large Language Model Long-Form Question Answering
par: Müller, Philip, et autres
Publié: (2026) -
Calibrated Large Language Models for Binary Question Answering
par: Giovannotti, Patrizio, et autres
Publié: (2024) -
Question Rephrasing for Quantifying Uncertainty in Large Language Models: Applications in Molecular Chemistry Tasks
par: Chen, Zizhang, et autres
Publié: (2024)