Beyond Confidence: Rethinking Uncertainty Calibration in Deep Code Models
Fuente:
Zenodo
Guardado en:
| Autor principal: | Anonymous Authors |
|---|---|
| Formato: | Recurso digital |
| Publicado: |
Zenodo
2026
|
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ExpML Source Code and Small-Scale Evaluation Transcription
por: Anonymous Authors
Publicado: (2025)
por: Anonymous Authors
Publicado: (2025)
Response for Questions from d5hH
por: Anonymous, Authors
Publicado: (2026)
por: Anonymous, Authors
Publicado: (2026)
LLM-based Structure Extraction Prompt for the Mapping Study
por: Anonymous Authors
Publicado: (2026)
por: Anonymous Authors
Publicado: (2026)
Dataset associated with paper "Studying the Generalization Abilities of Graph Neural Networks for Combinatorial Optimization: A Case Study on the Staff Scheduling Problem"
por: Anonymous Authors
Publicado: (2026)
por: Anonymous Authors
Publicado: (2026)
CoordSQL: A Multi-Agent Framework for Coordinated Natural Language to SQL Translation in Enterprise Databases
por: Anonymous Authors
Publicado: (2026)
por: Anonymous Authors
Publicado: (2026)
Online Supplementary Material
por: Anonymous Authors
Publicado: (2026)
por: Anonymous Authors
Publicado: (2026)
Replication package for ESEM2026 review
por: Anonymous, Authors
Publicado: (2026)
por: Anonymous, Authors
Publicado: (2026)
HintSMT
por: Anonymous Authors
Publicado: (2026)
por: Anonymous Authors
Publicado: (2026)
Artifacts for "WebCQ: Cooperative Multi-Agent Reinforcement Learning for Scalable Web GUI Testing"
por: Anonymous Authors
Publicado: (2026)
por: Anonymous Authors
Publicado: (2026)
Structured-Noise Deconvolution Benchmark — Representative Sample
por: Anonymous, Authors
Publicado: (2026)
por: Anonymous, Authors
Publicado: (2026)
Anonymous submission supplementary material
por: Anonymous, Authors
Publicado: (2026)
por: Anonymous, Authors
Publicado: (2026)
On Automatically Generating Assertions for Validating Reported Failures in Android Apps
por: Anonymous Authors
Publicado: (2025)
por: Anonymous Authors
Publicado: (2025)
Representative cases for FAITH
por: Anonymous Authors
Publicado: (2025)
por: Anonymous Authors
Publicado: (2025)
Revisiting Android Malware Detectors: an Unbiased Study
por: Anonymous, Authors
Publicado: (2025)
por: Anonymous, Authors
Publicado: (2025)
Anonymized repository for submission 248 - IEEE ICWS 2025
por: Anonymous Authors
Publicado: (2025)
por: Anonymous Authors
Publicado: (2025)
Anonymized repository for submission 248 - IEEE ICWS 2025
por: Anonymous Authors
Publicado: (2025)
por: Anonymous Authors
Publicado: (2025)
Revisiting Android Malware Detectors: an Unbiased Study
por: Anonymous, Authors
Publicado: (2025)
por: Anonymous, Authors
Publicado: (2025)
CRAKEN Supplementary Materials
por: Anonymous Authors
Publicado: (2025)
por: Anonymous Authors
Publicado: (2025)
Identifying and Bridging the Gap between Code Generation and Reasoning in LLMs
por: Authors
Publicado: (2026)
por: Authors
Publicado: (2026)
Replication package for "On Coding Agent Issue Localization Accuracy An Exploratory Study"
por: Authors Blind
Publicado: (2026)
por: Authors Blind
Publicado: (2026)
Uncertainty-Aware Post-Hoc Calibration: Mitigating Confidently Incorrect Predictions Beyond Calibration Metrics
por: Gharoun, Hassan, et al.
Publicado: (2025)
por: Gharoun, Hassan, et al.
Publicado: (2025)
Adaptive Silent Data Corruption Detection for NPUs via Hierarchical MCTS
por: Authors
Publicado: (2026)
por: Authors
Publicado: (2026)
Uncertainty Quantification and Confidence Calibration in Large Language Models: A Survey
por: Liu, Xiaoou, et al.
Publicado: (2025)
por: Liu, Xiaoou, et al.
Publicado: (2025)
Localized Calibrated Uncertainty in Code Language Models
por: Gros, David, et al.
Publicado: (2025)
por: Gros, David, et al.
Publicado: (2025)
Expectation Consistency Loss: Rethink Confidence Calibration under Covariate Shift
por: Dong, Jinzong, et al.
Publicado: (2026)
por: Dong, Jinzong, et al.
Publicado: (2026)
Beyond Confidence: Rethinking Self-Assessments for Performance Prediction in LLMs
por: Bhattacharyya, Sree, et al.
Publicado: (2026)
por: Bhattacharyya, Sree, et al.
Publicado: (2026)
CritiCal: Can Critique Help LLM Uncertainty or Confidence Calibration?
por: Zong, Qing, et al.
Publicado: (2025)
por: Zong, Qing, et al.
Publicado: (2025)
Rethinking Gaussian Trajectory Predictors: Calibrated Uncertainty for Safe Planning
por: Pouria, Fatemeh Cheraghi, et al.
Publicado: (2026)
por: Pouria, Fatemeh Cheraghi, et al.
Publicado: (2026)
Confidence Calibration in Large Language Models
por: Michael, Noam, et al.
Publicado: (2026)
por: Michael, Noam, et al.
Publicado: (2026)
Fine-grained Approaches for Confidence Calibration of LLMs in Automated Code Revision
por: Lin, Hong Yi, et al.
Publicado: (2026)
por: Lin, Hong Yi, et al.
Publicado: (2026)
Confidence Should Be Calibrated More Than One Turn Deep
por: Zhang, Zhaohan, et al.
Publicado: (2026)
por: Zhang, Zhaohan, et al.
Publicado: (2026)
Proceedings of the International Conference on Dublin Core and Metadata for e-Communities
por: AA.VV, Various Authors
Publicado: (2010)
por: AA.VV, Various Authors
Publicado: (2010)
Trusted Uncertainty in Large Language Models: A Unified Framework for Confidence Calibration and Risk-Controlled Refusal
por: Oehri, Markus, et al.
Publicado: (2025)
por: Oehri, Markus, et al.
Publicado: (2025)
Agentic Confidence Calibration
por: Zhang, Jiaxin, et al.
Publicado: (2026)
por: Zhang, Jiaxin, et al.
Publicado: (2026)
Beyond ECE: Calibrated Size Ratio, Risk Assessment, and Confidence-Weighted Metrics
por: Martin-Maroto, Fernando, et al.
Publicado: (2026)
por: Martin-Maroto, Fernando, et al.
Publicado: (2026)
QA-Calibration of Language Model Confidence Scores
por: Manggala, Putra, et al.
Publicado: (2024)
por: Manggala, Putra, et al.
Publicado: (2024)
Confidence Calibration in Vision-Language-Action Models
por: Zollo, Thomas P, et al.
Publicado: (2025)
por: Zollo, Thomas P, et al.
Publicado: (2025)
Confidence-Aware Multi-Field Model Calibration
por: Zhao, Yuang, et al.
Publicado: (2024)
por: Zhao, Yuang, et al.
Publicado: (2024)
How Confident Is the First Token? An Uncertainty-Calibrated Prompt Optimization Framework for Large Language Model Classification and Understanding
por: Chen, Wei, et al.
Publicado: (2026)
por: Chen, Wei, et al.
Publicado: (2026)
VL-Calibration: Decoupled Confidence Calibration for Large Vision-Language Models Reasoning
por: Xiao, Wenyi, et al.
Publicado: (2026)
por: Xiao, Wenyi, et al.
Publicado: (2026)
Ejemplares similares
-
ExpML Source Code and Small-Scale Evaluation Transcription
por: Anonymous Authors
Publicado: (2025) -
Response for Questions from d5hH
por: Anonymous, Authors
Publicado: (2026) -
LLM-based Structure Extraction Prompt for the Mapping Study
por: Anonymous Authors
Publicado: (2026) -
Dataset associated with paper "Studying the Generalization Abilities of Graph Neural Networks for Combinatorial Optimization: A Case Study on the Staff Scheduling Problem"
por: Anonymous Authors
Publicado: (2026) -
CoordSQL: A Multi-Agent Framework for Coordinated Natural Language to SQL Translation in Enterprise Databases
por: Anonymous Authors
Publicado: (2026)