Calibrated Large Language Models for Binary Question Answering
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Giovannotti, Patrizio, Gammerman, Alexander |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Benchmarking Uncertainty Calibration in Large Language Model Long-Form Question Answering
par: Müller, Philip, et autres
Publié: (2026)
par: Müller, Philip, et autres
Publié: (2026)
On the Calibration of Multilingual Question Answering LLMs
par: Yang, Yahan, et autres
Publié: (2023)
par: Yang, Yahan, et autres
Publié: (2023)
Dynamic Strategy Planning for Efficient Question Answering with Large Language Models
par: Parekh, Tanmay, et autres
Publié: (2024)
par: Parekh, Tanmay, et autres
Publié: (2024)
Quantifying Uncertainty in Natural Language Explanations of Large Language Models for Question Answering
par: Li, Yangyi, et autres
Publié: (2025)
par: Li, Yangyi, et autres
Publié: (2025)
MEG: Medical Knowledge-Augmented Large Language Models for Question Answering
par: Cabello, Laura, et autres
Publié: (2024)
par: Cabello, Laura, et autres
Publié: (2024)
Language Model Knowledge Distillation for Efficient Question Answering in Spanish
par: Bazaga, Adrián, et autres
Publié: (2023)
par: Bazaga, Adrián, et autres
Publié: (2023)
Machine Learning: Progress and Prospects
par: Gammerman, Alexander
Publié: (2025)
par: Gammerman, Alexander
Publié: (2025)
A Study on Large Language Models' Limitations in Multiple-Choice Question Answering
par: Khatun, Aisha, et autres
Publié: (2024)
par: Khatun, Aisha, et autres
Publié: (2024)
A Large-Scale Benchmark for Evaluating Large Language Models on Medical Question Answering in Romanian
par: Rogoz, Ana-Cristina, et autres
Publié: (2025)
par: Rogoz, Ana-Cristina, et autres
Publié: (2025)
FacLens: Transferable Probe for Foreseeing Non-Factuality in Fact-Seeking Question Answering of Large Language Models
par: Wang, Yanling, et autres
Publié: (2024)
par: Wang, Yanling, et autres
Publié: (2024)
Assessing Modality Bias in Video Question Answering Benchmarks with Multimodal Large Language Models
par: Park, Jean, et autres
Publié: (2024)
par: Park, Jean, et autres
Publié: (2024)
MedFuzz: Exploring the Robustness of Large Language Models in Medical Question Answering
par: Ness, Robert Osazuwa, et autres
Publié: (2024)
par: Ness, Robert Osazuwa, et autres
Publié: (2024)
CRAFT: Calibrated Reasoning with Answer-Faithful Traces via Reinforcement Learning for Multi-Hop Question Answering
par: Liu, Yu, et autres
Publié: (2026)
par: Liu, Yu, et autres
Publié: (2026)
SQuARE: Sequential Question Answering Reasoning Engine for Enhanced Chain-of-Thought in Large Language Models
par: Fleischer, Daniel, et autres
Publié: (2025)
par: Fleischer, Daniel, et autres
Publié: (2025)
A Semantic-Sampling Framework for Evaluating Calibration in Open-Ended Question Answering
par: Wang, Zhanliang, et autres
Publié: (2026)
par: Wang, Zhanliang, et autres
Publié: (2026)
Fine-Tuning Large Language Models and Evaluating Retrieval Methods for Improved Question Answering on Building Codes
par: Aqib, Mohammad, et autres
Publié: (2025)
par: Aqib, Mohammad, et autres
Publié: (2025)
MapIQ: Evaluating Multimodal Large Language Models for Map Question Answering
par: Srivastava, Varun, et autres
Publié: (2025)
par: Srivastava, Varun, et autres
Publié: (2025)
ESQA: Event Sequences Question Answering
par: Abdullaeva, Irina, et autres
Publié: (2024)
par: Abdullaeva, Irina, et autres
Publié: (2024)
Structured RAG for Answering Aggregative Questions
par: Koshorek, Omri, et autres
Publié: (2025)
par: Koshorek, Omri, et autres
Publié: (2025)
On Mechanistic Circuits for Extractive Question-Answering
par: Basu, Samyadeep, et autres
Publié: (2025)
par: Basu, Samyadeep, et autres
Publié: (2025)
MedLM: Exploring Language Models for Medical Question Answering Systems
par: Yagnik, Niraj, et autres
Publié: (2024)
par: Yagnik, Niraj, et autres
Publié: (2024)
Thermometer: Towards Universal Calibration for Large Language Models
par: Shen, Maohao, et autres
Publié: (2024)
par: Shen, Maohao, et autres
Publié: (2024)
Prophet: Prompting Large Language Models with Complementary Answer Heuristics for Knowledge-based Visual Question Answering
par: Yu, Zhou, et autres
Publié: (2023)
par: Yu, Zhou, et autres
Publié: (2023)
Prompting Medical Large Vision-Language Models to Diagnose Pathologies by Visual Question Answering
par: Guo, Danfeng, et autres
Publié: (2024)
par: Guo, Danfeng, et autres
Publié: (2024)
Interpretable LLM-based Table Question Answering
par: Nguyen, Giang, et autres
Publié: (2024)
par: Nguyen, Giang, et autres
Publié: (2024)
Explainable Fact-checking through Question Answering
par: Yang, Jing, et autres
Publié: (2021)
par: Yang, Jing, et autres
Publié: (2021)
Retrieval-enhanced Knowledge Editing in Language Models for Multi-Hop Question Answering
par: Shi, Yucheng, et autres
Publié: (2024)
par: Shi, Yucheng, et autres
Publié: (2024)
IndicSQuAD: A Comprehensive Multilingual Question Answering Dataset for Indic Languages
par: Endait, Sharvi, et autres
Publié: (2025)
par: Endait, Sharvi, et autres
Publié: (2025)
OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models
par: Shao, Wenqi, et autres
Publié: (2023)
par: Shao, Wenqi, et autres
Publié: (2023)
Confidence Calibration in Large Language Model-Based Entity Matching
par: Kamsteeg, Iris, et autres
Publié: (2025)
par: Kamsteeg, Iris, et autres
Publié: (2025)
Honest Students from Untrusted Teachers: Learning an Interpretable Question-Answering Pipeline from a Pretrained Language Model
par: Eisenstein, Jacob, et autres
Publié: (2022)
par: Eisenstein, Jacob, et autres
Publié: (2022)
OWLViz: An Open-World Benchmark for Visual Question Answering
par: Nguyen, Thuy, et autres
Publié: (2025)
par: Nguyen, Thuy, et autres
Publié: (2025)
FoQA: A Faroese Question-Answering Dataset
par: Simonsen, Annika, et autres
Publié: (2025)
par: Simonsen, Annika, et autres
Publié: (2025)
SyllabusQA: A Course Logistics Question Answering Dataset
par: Fernandez, Nigel, et autres
Publié: (2024)
par: Fernandez, Nigel, et autres
Publié: (2024)
Question-Aware Knowledge Graph Prompting for Enhancing Large Language Models
par: Liu, Haochen, et autres
Publié: (2025)
par: Liu, Haochen, et autres
Publié: (2025)
Refusal Tokens: A Simple Way to Calibrate Refusals in Large Language Models
par: Jain, Neel, et autres
Publié: (2024)
par: Jain, Neel, et autres
Publié: (2024)
Modality-Aware Integration with Large Language Models for Knowledge-based Visual Question Answering
par: Dong, Junnan, et autres
Publié: (2024)
par: Dong, Junnan, et autres
Publié: (2024)
Interpretable Question Answering with Knowledge Graphs
par: Aneja, Kartikeya, et autres
Publié: (2025)
par: Aneja, Kartikeya, et autres
Publié: (2025)
Towards Faithful and Robust LLM Specialists for Evidence-Based Question-Answering
par: Schimanski, Tobias, et autres
Publié: (2024)
par: Schimanski, Tobias, et autres
Publié: (2024)
MahaSQuAD: Bridging Linguistic Divides in Marathi Question-Answering
par: Ghatage, Ruturaj, et autres
Publié: (2024)
par: Ghatage, Ruturaj, et autres
Publié: (2024)
Documents similaires
-
Benchmarking Uncertainty Calibration in Large Language Model Long-Form Question Answering
par: Müller, Philip, et autres
Publié: (2026) -
On the Calibration of Multilingual Question Answering LLMs
par: Yang, Yahan, et autres
Publié: (2023) -
Dynamic Strategy Planning for Efficient Question Answering with Large Language Models
par: Parekh, Tanmay, et autres
Publié: (2024) -
Quantifying Uncertainty in Natural Language Explanations of Large Language Models for Question Answering
par: Li, Yangyi, et autres
Publié: (2025) -
MEG: Medical Knowledge-Augmented Large Language Models for Question Answering
par: Cabello, Laura, et autres
Publié: (2024)