Believe Your Model: Distribution-Guided Confidence Calibration
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Xizhong, Zhang, Haotian, Wang, Huiming, Song, Mofei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
From the Inside Out: Progressive Distribution Refinement for Confidence Calibration
por: Yang, Xizhong, et al.
Publicado: (2026)
por: Yang, Xizhong, et al.
Publicado: (2026)
Semantic Bridging Domains: Pseudo-Source as Test-Time Connector
por: Yang, Xizhong, et al.
Publicado: (2026)
por: Yang, Xizhong, et al.
Publicado: (2026)
To Believe or Not to Believe Your LLM
por: Yadkori, Yasin Abbasi, et al.
Publicado: (2024)
por: Yadkori, Yasin Abbasi, et al.
Publicado: (2024)
Similarity and Dissimilarity Guided Co-association Matrix Construction for Ensemble Clustering
por: Zhang, Xu, et al.
Publicado: (2024)
por: Zhang, Xu, et al.
Publicado: (2024)
Your Pre-trained LLM is Secretly an Unsupervised Confidence Calibrator
por: Luo, Beier, et al.
Publicado: (2025)
por: Luo, Beier, et al.
Publicado: (2025)
Balancing the Reasoning Load: Difficulty-Differentiated Policy Optimization with Length Redistribution for Efficient and Robust Reinforcement Learning
por: Xia, Yinan, et al.
Publicado: (2026)
por: Xia, Yinan, et al.
Publicado: (2026)
Confidence-Aware Multi-Field Model Calibration
por: Zhao, Yuang, et al.
Publicado: (2024)
por: Zhao, Yuang, et al.
Publicado: (2024)
DP$^2$-NILM: A Distributed and Privacy-preserving Framework for Non-intrusive Load Monitoring
por: Dai, Shuang, et al.
Publicado: (2022)
por: Dai, Shuang, et al.
Publicado: (2022)
Confidence Calibration in Large Language Models
por: Michael, Noam, et al.
Publicado: (2026)
por: Michael, Noam, et al.
Publicado: (2026)
Confidence Calibration in Vision-Language-Action Models
por: Zollo, Thomas P, et al.
Publicado: (2025)
por: Zollo, Thomas P, et al.
Publicado: (2025)
CHARM: Calibrating Reward Models With Chatbot Arena Scores
por: Zhu, Xiao, et al.
Publicado: (2025)
por: Zhu, Xiao, et al.
Publicado: (2025)
Enhance GNNs with Reliable Confidence Estimation via Adversarial Calibration Learning
por: Wang, Yilong, et al.
Publicado: (2025)
por: Wang, Yilong, et al.
Publicado: (2025)
Prior Distribution and Model Confidence
por: Kazanskii, Maksim, et al.
Publicado: (2025)
por: Kazanskii, Maksim, et al.
Publicado: (2025)
QA-Calibration of Language Model Confidence Scores
por: Manggala, Putra, et al.
Publicado: (2024)
por: Manggala, Putra, et al.
Publicado: (2024)
Efficient RLVR Training via Weighted Mutual Information Data Selection
por: Zhou, Xinyu, et al.
Publicado: (2026)
por: Zhou, Xinyu, et al.
Publicado: (2026)
Show Your Work with Confidence: Confidence Bands for Tuning Curves
por: Lourie, Nicholas, et al.
Publicado: (2023)
por: Lourie, Nicholas, et al.
Publicado: (2023)
Confidence over Time: Confidence Calibration with Temporal Logic for Large Language Model Reasoning
por: Mao, Zhenjiang, et al.
Publicado: (2026)
por: Mao, Zhenjiang, et al.
Publicado: (2026)
Expectation Consistency Loss: Rethink Confidence Calibration under Covariate Shift
por: Dong, Jinzong, et al.
Publicado: (2026)
por: Dong, Jinzong, et al.
Publicado: (2026)
Conformal Calibration of Statistical Confidence Sets
por: Cabezas, Luben M. C., et al.
Publicado: (2024)
por: Cabezas, Luben M. C., et al.
Publicado: (2024)
DexSim2Real: Foundation Model-Guided Sim-to-Real Transfer for Generalizable Dexterous Manipulation
por: Zeng, Zijian, et al.
Publicado: (2026)
por: Zeng, Zijian, et al.
Publicado: (2026)
Unsupervised Confidence Calibration for Reasoning LLMs from a Single Generation
por: Zollo, Thomas, et al.
Publicado: (2026)
por: Zollo, Thomas, et al.
Publicado: (2026)
Confidence Calibration of Classifiers with Many Classes
por: LeCoz, Adrien, et al.
Publicado: (2024)
por: LeCoz, Adrien, et al.
Publicado: (2024)
Learn to Guide Your Diffusion Model
por: Galashov, Alexandre, et al.
Publicado: (2025)
por: Galashov, Alexandre, et al.
Publicado: (2025)
Confidence Calibration in Large Language Model-Based Entity Matching
por: Kamsteeg, Iris, et al.
Publicado: (2025)
por: Kamsteeg, Iris, et al.
Publicado: (2025)
Graph-based Confidence Calibration for Large Language Models
por: Li, Yukun, et al.
Publicado: (2024)
por: Li, Yukun, et al.
Publicado: (2024)
Process Supervision of Confidence Margin for Calibrated LLM Reasoning
por: Wang, Liaoyaqi, et al.
Publicado: (2026)
por: Wang, Liaoyaqi, et al.
Publicado: (2026)
Confidence Calibration under Ambiguous Ground Truth
por: Tao, Linwei, et al.
Publicado: (2026)
por: Tao, Linwei, et al.
Publicado: (2026)
MARGIN: Runtime Confidence Calibration for Multi-Agent Foundation Model Coordination
por: Armstrong, Joss
Publicado: (2026)
por: Armstrong, Joss
Publicado: (2026)
Calibration Attacks: A Comprehensive Study of Adversarial Attacks on Model Confidence
por: Obadinma, Stephen, et al.
Publicado: (2024)
por: Obadinma, Stephen, et al.
Publicado: (2024)
A Confidence Interval for the $\ell_2$ Expected Calibration Error
por: Sun, Yan, et al.
Publicado: (2024)
por: Sun, Yan, et al.
Publicado: (2024)
Semantic-Aware Confidence Calibration for Automated Audio Captioning
por: Dunker, Lucas, et al.
Publicado: (2025)
por: Dunker, Lucas, et al.
Publicado: (2025)
Is Your Explanation Reliable: Confidence-Aware Explanation on Graph Neural Networks
por: Zhang, Jiaxing, et al.
Publicado: (2025)
por: Zhang, Jiaxing, et al.
Publicado: (2025)
Identifiable Deep Latent Variable Models for MNAR Data
por: Xie, Huiming, et al.
Publicado: (2026)
por: Xie, Huiming, et al.
Publicado: (2026)
Improving the Throughput of Diffusion-based Large Language Models via a Training-Free Confidence-Aware Calibration
por: Shen, Jucheng, et al.
Publicado: (2025)
por: Shen, Jucheng, et al.
Publicado: (2025)
CodeScaler: Scaling Code LLM Training and Test-Time Inference via Reward Models
por: Zhu, Xiao, et al.
Publicado: (2026)
por: Zhu, Xiao, et al.
Publicado: (2026)
Combining Priors with Experience: Confidence Calibration Based on Binomial Process Modeling
por: Dong, Jinzong, et al.
Publicado: (2024)
por: Dong, Jinzong, et al.
Publicado: (2024)
Calibrating Generative Models to Distributional Constraints
por: Smith, Henry D., et al.
Publicado: (2025)
por: Smith, Henry D., et al.
Publicado: (2025)
MICE for CATs: Model-Internal Confidence Estimation for Calibrating Agents with Tools
por: Subramani, Nishant, et al.
Publicado: (2025)
por: Subramani, Nishant, et al.
Publicado: (2025)
Performance Estimation in Binary Classification Using Calibrated Confidence
por: Kivimäki, Juhani, et al.
Publicado: (2025)
por: Kivimäki, Juhani, et al.
Publicado: (2025)
SpecBound: Adaptive Bounded Self-Speculation with Layer-wise Confidence Calibration
por: Wen, Zhuofan, et al.
Publicado: (2026)
por: Wen, Zhuofan, et al.
Publicado: (2026)
Ejemplares similares
-
From the Inside Out: Progressive Distribution Refinement for Confidence Calibration
por: Yang, Xizhong, et al.
Publicado: (2026) -
Semantic Bridging Domains: Pseudo-Source as Test-Time Connector
por: Yang, Xizhong, et al.
Publicado: (2026) -
To Believe or Not to Believe Your LLM
por: Yadkori, Yasin Abbasi, et al.
Publicado: (2024) -
Similarity and Dissimilarity Guided Co-association Matrix Construction for Ensemble Clustering
por: Zhang, Xu, et al.
Publicado: (2024) -
Your Pre-trained LLM is Secretly an Unsupervised Confidence Calibrator
por: Luo, Beier, et al.
Publicado: (2025)