Unsupervised Confidence Calibration for Reasoning LLMs from a Single Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zollo, Thomas, Wang, Jimmy, Zemel, Richard |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Confidence Calibration in Vision-Language-Action Models
par: Zollo, Thomas P, et autres
Publié: (2025)
par: Zollo, Thomas P, et autres
Publié: (2025)
Adaptive Elicitation of Latent Information Using Natural Language
par: Wang, Jimmy, et autres
Publié: (2025)
par: Wang, Jimmy, et autres
Publié: (2025)
Tell Me What To Learn: Generalizing Neural Memory to be Controllable in Natural Language
par: Bennett, Max S., et autres
Publié: (2026)
par: Bennett, Max S., et autres
Publié: (2026)
Test-Time Warmup for Multimodal Large Language Models
par: Rajaneesh, Nikita, et autres
Publié: (2025)
par: Rajaneesh, Nikita, et autres
Publié: (2025)
Towards Effective Discrimination Testing for Generative AI
par: Zollo, Thomas P., et autres
Publié: (2024)
par: Zollo, Thomas P., et autres
Publié: (2024)
Guiding LLM Decision-Making with Fairness Reward Models
par: Hall, Zara, et autres
Publié: (2025)
par: Hall, Zara, et autres
Publié: (2025)
Distribution-Free Statistical Dispersion Control for Societal Applications
par: Deng, Zhun, et autres
Publié: (2023)
par: Deng, Zhun, et autres
Publié: (2023)
QuEst: Enhancing Estimates of Quantile-Based Distributional Measures Using Model Predictions
par: Deng, Zhun, et autres
Publié: (2025)
par: Deng, Zhun, et autres
Publié: (2025)
Improving Predictor Reliability with Selective Recalibration
par: Zollo, Thomas P., et autres
Publié: (2024)
par: Zollo, Thomas P., et autres
Publié: (2024)
Prompt Risk Control: A Rigorous Framework for Responsible Deployment of Large Language Models
par: Zollo, Thomas P., et autres
Publié: (2023)
par: Zollo, Thomas P., et autres
Publié: (2023)
Whom to Query for What: Adaptive Group Elicitation via Multi-Turn LLM Interactions
par: Ding, Ruomeng, et autres
Publié: (2026)
par: Ding, Ruomeng, et autres
Publié: (2026)
Your Pre-trained LLM is Secretly an Unsupervised Confidence Calibrator
par: Luo, Beier, et autres
Publié: (2025)
par: Luo, Beier, et autres
Publié: (2025)
Integrating Present and Past in Unsupervised Continual Learning
par: Zhang, Yipeng, et autres
Publié: (2024)
par: Zhang, Yipeng, et autres
Publié: (2024)
Online Algorithmic Recourse by Collective Action
par: Creager, Elliot, et autres
Publié: (2023)
par: Creager, Elliot, et autres
Publié: (2023)
Let the Experts Speak: Improving Survival Prediction & Calibration via Mixture-of-Experts Heads
par: Morrill, Todd, et autres
Publié: (2025)
par: Morrill, Todd, et autres
Publié: (2025)
Process Supervision of Confidence Margin for Calibrated LLM Reasoning
par: Wang, Liaoyaqi, et autres
Publié: (2026)
par: Wang, Liaoyaqi, et autres
Publié: (2026)
CER: Confidence Enhanced Reasoning in LLMs
par: Razghandi, Ali, et autres
Publié: (2025)
par: Razghandi, Ali, et autres
Publié: (2025)
Confidence over Time: Confidence Calibration with Temporal Logic for Large Language Model Reasoning
par: Mao, Zhenjiang, et autres
Publié: (2026)
par: Mao, Zhenjiang, et autres
Publié: (2026)
Calibration of Network Confidence for Unsupervised Domain Adaptation Using Estimated Accuracy
par: Penso, Coby, et autres
Publié: (2024)
par: Penso, Coby, et autres
Publié: (2024)
Few-Shot Design Optimization by Exploiting Auxiliary Information
par: Mani, Arjun, et autres
Publié: (2026)
par: Mani, Arjun, et autres
Publié: (2026)
Calibration-Aware Policy Optimization for Reasoning LLMs
par: Wang, Ziqi, et autres
Publié: (2026)
par: Wang, Ziqi, et autres
Publié: (2026)
Believe Your Model: Distribution-Guided Confidence Calibration
par: Yang, Xizhong, et autres
Publié: (2026)
par: Yang, Xizhong, et autres
Publié: (2026)
Decoupling Reasoning and Confidence: Resurrecting Calibration in Reinforcement Learning from Verifiable Rewards
par: Ma, Zhengzhao, et autres
Publié: (2026)
par: Ma, Zhengzhao, et autres
Publié: (2026)
Conformal Calibration of Statistical Confidence Sets
par: Cabezas, Luben M. C., et autres
Publié: (2024)
par: Cabezas, Luben M. C., et autres
Publié: (2024)
LLMs are Overconfident: Evaluating Confidence Interval Calibration with FermiEval
par: Epstein, Elliot L., et autres
Publié: (2025)
par: Epstein, Elliot L., et autres
Publié: (2025)
Confidence-Aware Multi-Field Model Calibration
par: Zhao, Yuang, et autres
Publié: (2024)
par: Zhao, Yuang, et autres
Publié: (2024)
Enhance GNNs with Reliable Confidence Estimation via Adversarial Calibration Learning
par: Wang, Yilong, et autres
Publié: (2025)
par: Wang, Yilong, et autres
Publié: (2025)
Split Conformal Classification with Unsupervised Calibration
par: Mazuelas, Santiago
Publié: (2025)
par: Mazuelas, Santiago
Publié: (2025)
Confidence Calibration in Large Language Models
par: Michael, Noam, et autres
Publié: (2026)
par: Michael, Noam, et autres
Publié: (2026)
Confidence Calibration of Classifiers with Many Classes
par: LeCoz, Adrien, et autres
Publié: (2024)
par: LeCoz, Adrien, et autres
Publié: (2024)
The Effects of Data Augmentation on Confidence Estimation for LLMs
par: Wang, Rui, et autres
Publié: (2025)
par: Wang, Rui, et autres
Publié: (2025)
Level Up: Defining and Exploiting Transitional Problems for Curriculum Learning
par: Tang, Zhenwei, et autres
Publié: (2026)
par: Tang, Zhenwei, et autres
Publié: (2026)
Out of the Ordinary: Spectrally Adapting Regression for Covariate Shift
par: Eyre, Benjamin, et autres
Publié: (2023)
par: Eyre, Benjamin, et autres
Publié: (2023)
Confidence Calibration under Ambiguous Ground Truth
par: Tao, Linwei, et autres
Publié: (2026)
par: Tao, Linwei, et autres
Publié: (2026)
QA-Calibration of Language Model Confidence Scores
par: Manggala, Putra, et autres
Publié: (2024)
par: Manggala, Putra, et autres
Publié: (2024)
A Confidence Interval for the $\ell_2$ Expected Calibration Error
par: Sun, Yan, et autres
Publié: (2024)
par: Sun, Yan, et autres
Publié: (2024)
From the Inside Out: Progressive Distribution Refinement for Confidence Calibration
par: Yang, Xizhong, et autres
Publié: (2026)
par: Yang, Xizhong, et autres
Publié: (2026)
Semantic-Aware Confidence Calibration for Automated Audio Captioning
par: Dunker, Lucas, et autres
Publié: (2025)
par: Dunker, Lucas, et autres
Publié: (2025)
Towards Understanding Self-Pretraining for Sequence Classification
par: Coser, Omar, et autres
Publié: (2026)
par: Coser, Omar, et autres
Publié: (2026)
Expectation Consistency Loss: Rethink Confidence Calibration under Covariate Shift
par: Dong, Jinzong, et autres
Publié: (2026)
par: Dong, Jinzong, et autres
Publié: (2026)
Documents similaires
-
Confidence Calibration in Vision-Language-Action Models
par: Zollo, Thomas P, et autres
Publié: (2025) -
Adaptive Elicitation of Latent Information Using Natural Language
par: Wang, Jimmy, et autres
Publié: (2025) -
Tell Me What To Learn: Generalizing Neural Memory to be Controllable in Natural Language
par: Bennett, Max S., et autres
Publié: (2026) -
Test-Time Warmup for Multimodal Large Language Models
par: Rajaneesh, Nikita, et autres
Publié: (2025) -
Towards Effective Discrimination Testing for Generative AI
par: Zollo, Thomas P., et autres
Publié: (2024)