Confidence Calibration in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Michael, Noam, BenShushan, Daniel, Bien, Jacob, Moore, Don A. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Graph-based Confidence Calibration for Large Language Models
di: Li, Yukun, et al.
Pubblicazione: (2024)
di: Li, Yukun, et al.
Pubblicazione: (2024)
Confidence Calibration of Classifiers with Many Classes
di: LeCoz, Adrien, et al.
Pubblicazione: (2024)
di: LeCoz, Adrien, et al.
Pubblicazione: (2024)
Confidence Calibration under Ambiguous Ground Truth
di: Tao, Linwei, et al.
Pubblicazione: (2026)
di: Tao, Linwei, et al.
Pubblicazione: (2026)
Confidence Regulation Neurons in Language Models
di: Stolfo, Alessandro, et al.
Pubblicazione: (2024)
di: Stolfo, Alessandro, et al.
Pubblicazione: (2024)
Confidence Under the Hood: An Investigation into the Confidence-Probability Alignment in Large Language Models
di: Kumar, Abhishek, et al.
Pubblicazione: (2024)
di: Kumar, Abhishek, et al.
Pubblicazione: (2024)
Beyond Correctness: Confidence-Aware Reward Modeling for Enhancing Large Language Model Reasoning
di: He, Qianxi, et al.
Pubblicazione: (2025)
di: He, Qianxi, et al.
Pubblicazione: (2025)
Restoring Calibration for Aligned Large Language Models: A Calibration-Aware Fine-Tuning Approach
di: Xiao, Jiancong, et al.
Pubblicazione: (2025)
di: Xiao, Jiancong, et al.
Pubblicazione: (2025)
Saliency-Aware Regularized Quantization Calibration for Large Language Models
di: Zhao, Yanlong, et al.
Pubblicazione: (2026)
di: Zhao, Yanlong, et al.
Pubblicazione: (2026)
Combining Priors with Experience: Confidence Calibration Based on Binomial Process Modeling
di: Dong, Jinzong, et al.
Pubblicazione: (2024)
di: Dong, Jinzong, et al.
Pubblicazione: (2024)
Automatic Calibration for Membership Inference Attack on Large Language Models
di: Zade, Saleh Zare, et al.
Pubblicazione: (2025)
di: Zade, Saleh Zare, et al.
Pubblicazione: (2025)
Your Pre-trained LLM is Secretly an Unsupervised Confidence Calibrator
di: Luo, Beier, et al.
Pubblicazione: (2025)
di: Luo, Beier, et al.
Pubblicazione: (2025)
Confidence-Modulated Speculative Decoding for Large Language Models
di: Sen, Jaydip, et al.
Pubblicazione: (2025)
di: Sen, Jaydip, et al.
Pubblicazione: (2025)
MIRROR: A Hierarchical Benchmark for Metacognitive Calibration in Large Language Models
di: Wang, Jason Z
Pubblicazione: (2026)
di: Wang, Jason Z
Pubblicazione: (2026)
MICE for CATs: Model-Internal Confidence Estimation for Calibrating Agents with Tools
di: Subramani, Nishant, et al.
Pubblicazione: (2025)
di: Subramani, Nishant, et al.
Pubblicazione: (2025)
Large Language Model Confidence Estimation via Black-Box Access
di: Pedapati, Tejaswini, et al.
Pubblicazione: (2024)
di: Pedapati, Tejaswini, et al.
Pubblicazione: (2024)
Efficient Prediction of Pass@k Scaling in Large Language Models
di: Kazdan, Joshua, et al.
Pubblicazione: (2025)
di: Kazdan, Joshua, et al.
Pubblicazione: (2025)
Large Language Models and Algorithm Execution: Application to an Arithmetic Function
di: Slama, Farah Ben, et al.
Pubblicazione: (2026)
di: Slama, Farah Ben, et al.
Pubblicazione: (2026)
Where Paths Split: Localized, Calibrated Control of Moral Reasoning in Large Language Models
di: Yuan, Chenchen, et al.
Pubblicazione: (2026)
di: Yuan, Chenchen, et al.
Pubblicazione: (2026)
On Calibration of Large Language Models: From Response To Capability
di: Yang, Sin-Han, et al.
Pubblicazione: (2026)
di: Yang, Sin-Han, et al.
Pubblicazione: (2026)
Revisiting Uncertainty Estimation and Calibration of Large Language Models
di: Tao, Linwei, et al.
Pubblicazione: (2025)
di: Tao, Linwei, et al.
Pubblicazione: (2025)
Beware of Calibration Data for Pruning Large Language Models
di: Ji, Yixin, et al.
Pubblicazione: (2024)
di: Ji, Yixin, et al.
Pubblicazione: (2024)
Calibrating Large Language Models Using Their Generations Only
di: Ulmer, Dennis, et al.
Pubblicazione: (2024)
di: Ulmer, Dennis, et al.
Pubblicazione: (2024)
ERATTA: Extreme RAG for Table To Answers with Large Language Models
di: Roychowdhury, Sohini, et al.
Pubblicazione: (2024)
di: Roychowdhury, Sohini, et al.
Pubblicazione: (2024)
Does Calibration Affect Human Actions?
di: Nizri, Meir, et al.
Pubblicazione: (2025)
di: Nizri, Meir, et al.
Pubblicazione: (2025)
Calibrating Long-form Generations from Large Language Models
di: Huang, Yukun, et al.
Pubblicazione: (2024)
di: Huang, Yukun, et al.
Pubblicazione: (2024)
CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models
di: Li, Shuozhe, et al.
Pubblicazione: (2026)
di: Li, Shuozhe, et al.
Pubblicazione: (2026)
Large Language Models Should Ask Clarifying Questions to Increase Confidence in Generated Code
di: Wu, Jie JW
Pubblicazione: (2023)
di: Wu, Jie JW
Pubblicazione: (2023)
A Simple Model of Inference Scaling Laws
di: Levi, Noam
Pubblicazione: (2024)
di: Levi, Noam
Pubblicazione: (2024)
RACER: Risk-Aware Calibrated Efficient Routing for Large Language Models
di: Hao, Sai, et al.
Pubblicazione: (2026)
di: Hao, Sai, et al.
Pubblicazione: (2026)
Calibrating Bayesian Learning via Regularization, Confidence Minimization, and Selective Inference
di: Huang, Jiayi, et al.
Pubblicazione: (2024)
di: Huang, Jiayi, et al.
Pubblicazione: (2024)
SymDrift: One-Shot Generative Modeling under Symmetries
di: Darouich, Samir, et al.
Pubblicazione: (2026)
di: Darouich, Samir, et al.
Pubblicazione: (2026)
CPLLM: Clinical Prediction with Large Language Models
di: Shoham, Ofir Ben, et al.
Pubblicazione: (2023)
di: Shoham, Ofir Ben, et al.
Pubblicazione: (2023)
CALICO: Confident Active Learning with Integrated Calibration
di: Querol, Lorenzo S., et al.
Pubblicazione: (2024)
di: Querol, Lorenzo S., et al.
Pubblicazione: (2024)
Retrieval Capabilities of Large Language Models Scale with Pretraining FLOPs
di: Portes, Jacob, et al.
Pubblicazione: (2025)
di: Portes, Jacob, et al.
Pubblicazione: (2025)
Calibrated Language Models and How to Find Them with Label Smoothing
di: Huang, Jerry, et al.
Pubblicazione: (2025)
di: Huang, Jerry, et al.
Pubblicazione: (2025)
CalArena: A Large-Scale Post-Hoc Calibration Benchmark
di: Berta, Eugène, et al.
Pubblicazione: (2026)
di: Berta, Eugène, et al.
Pubblicazione: (2026)
On the Entropy Calibration of Language Models
di: Cao, Steven, et al.
Pubblicazione: (2025)
di: Cao, Steven, et al.
Pubblicazione: (2025)
Forecasting Application Counts in Talent Acquisition Platforms: Harnessing Multimodal Signals using LMs
di: Kabir, Md Ahsanul, et al.
Pubblicazione: (2024)
di: Kabir, Md Ahsanul, et al.
Pubblicazione: (2024)
Why is Your Language Model a Poor Implicit Reward Model?
di: Razin, Noam, et al.
Pubblicazione: (2025)
di: Razin, Noam, et al.
Pubblicazione: (2025)
Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning
di: Krishnan, Ranganath, et al.
Pubblicazione: (2024)
di: Krishnan, Ranganath, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Graph-based Confidence Calibration for Large Language Models
di: Li, Yukun, et al.
Pubblicazione: (2024) -
Confidence Calibration of Classifiers with Many Classes
di: LeCoz, Adrien, et al.
Pubblicazione: (2024) -
Confidence Calibration under Ambiguous Ground Truth
di: Tao, Linwei, et al.
Pubblicazione: (2026) -
Confidence Regulation Neurons in Language Models
di: Stolfo, Alessandro, et al.
Pubblicazione: (2024) -
Confidence Under the Hood: An Investigation into the Confidence-Probability Alignment in Large Language Models
di: Kumar, Abhishek, et al.
Pubblicazione: (2024)