Enregistré dans:
| Auteur principal: | Karge, Jonas |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.22413 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Constructive Interpolation and Concept-Based Beth Definability for Description Logics via Sequents
par: Lyon, Tim S., et autres
Publié: (2024)
par: Lyon, Tim S., et autres
Publié: (2024)
Agentic Confidence Calibration
par: Zhang, Jiaxin, et autres
Publié: (2026)
par: Zhang, Jiaxin, et autres
Publié: (2026)
Belief Filtering for Epistemic Control in Linguistic State Space
par: Dumbrava, Sebastian
Publié: (2025)
par: Dumbrava, Sebastian
Publié: (2025)
Examining Independence in Ensemble Sentiment Analysis: A Study on the Limits of Large Language Models Using the Condorcet Jury Theorem
par: Lefort, Baptiste, et autres
Publié: (2024)
par: Lefort, Baptiste, et autres
Publié: (2024)
12 Angry AI Agents: Evaluating Multi-Agent LLM Decision-Making Through Cinematic Jury Deliberation
par: Ersoz, Ahmet Bahaddin
Publié: (2026)
par: Ersoz, Ahmet Bahaddin
Publié: (2026)
The Accountability Horizon: An Impossibility Theorem for Governing Human-Agent Collectives
par: Tibebu, Haileleol
Publié: (2026)
par: Tibebu, Haileleol
Publié: (2026)
MICE for CATs: Model-Internal Confidence Estimation for Calibrating Agents with Tools
par: Subramani, Nishant, et autres
Publié: (2025)
par: Subramani, Nishant, et autres
Publié: (2025)
Architecting Trust in Artificial Epistemic Agents
par: Marchal, Nahema, et autres
Publié: (2026)
par: Marchal, Nahema, et autres
Publié: (2026)
When Planning Fails Despite Correct Execution: On Epistemic Calibration for LLM-Based Multi-Agent Systems
par: Wang, Zehao, et autres
Publié: (2026)
par: Wang, Zehao, et autres
Publié: (2026)
Towards Trustworthy Report Generation: A Deep Research Agent with Progressive Confidence Estimation and Calibration
par: Yuan, Yi, et autres
Publié: (2026)
par: Yuan, Yi, et autres
Publié: (2026)
Confidence Calibration in Large Language Models
par: Michael, Noam, et autres
Publié: (2026)
par: Michael, Noam, et autres
Publié: (2026)
Confidence Calibration of Classifiers with Many Classes
par: LeCoz, Adrien, et autres
Publié: (2024)
par: LeCoz, Adrien, et autres
Publié: (2024)
Attractor Geometry of Transformer Memory: From Conflict Arbitration to Confident Hallucination
par: Liang, Qiyao, et autres
Publié: (2026)
par: Liang, Qiyao, et autres
Publié: (2026)
Calibrated Language Models Must Hallucinate
par: Kalai, Adam Tauman, et autres
Publié: (2023)
par: Kalai, Adam Tauman, et autres
Publié: (2023)
Asking Is Not Enough: Protocol Sensitivity in LLM Confidence Calibration
par: Kim, Hankyeol, et autres
Publié: (2026)
par: Kim, Hankyeol, et autres
Publié: (2026)
Calibrated Trust in Dealing with LLM Hallucinations: A Qualitative Study
par: Ryser, Adrian, et autres
Publié: (2025)
par: Ryser, Adrian, et autres
Publié: (2025)
Refine and Align: Confidence Calibration through Multi-Agent Interaction in VQA
par: Pandey, Ayush, et autres
Publié: (2025)
par: Pandey, Ayush, et autres
Publié: (2025)
Confidence Calibration under Ambiguous Ground Truth
par: Tao, Linwei, et autres
Publié: (2026)
par: Tao, Linwei, et autres
Publié: (2026)
Calibrating Verbalized Confidence with Self-Generated Distractors
par: Wang, Victor, et autres
Publié: (2025)
par: Wang, Victor, et autres
Publié: (2025)
Fact-Level Confidence Calibration and Self-Correction
par: Yuan, Yige, et autres
Publié: (2024)
par: Yuan, Yige, et autres
Publié: (2024)
The First Token Knows: Single-Decode Confidence for Hallucination Detection
par: Gabriel, Mina
Publié: (2026)
par: Gabriel, Mina
Publié: (2026)
Deterministic Hallucination Detection in Medical VQA via Confidence-Evidence Bayesian Gain
par: Asadi, Mohammad, et autres
Publié: (2026)
par: Asadi, Mohammad, et autres
Publié: (2026)
Jury: A Comprehensive Evaluation Toolkit
par: Cavusoglu, Devrim, et autres
Publié: (2023)
par: Cavusoglu, Devrim, et autres
Publié: (2023)
Double-Calibration: Towards Reliable LLMs via Calibrating Knowledge and Reasoning Confidence
par: Lu, Yuyin, et autres
Publié: (2026)
par: Lu, Yuyin, et autres
Publié: (2026)
The Confidence Gate Theorem: When Should Ranked Decision Systems Abstain?
par: Doku, Ronald
Publié: (2026)
par: Doku, Ronald
Publié: (2026)
A Survey of Confidence Estimation and Calibration in Large Language Models
par: Geng, Jiahui, et autres
Publié: (2023)
par: Geng, Jiahui, et autres
Publié: (2023)
I-CALM: Incentivizing Confidence-Aware Abstention for LLM Hallucination Mitigation
par: Zong, Haotian, et autres
Publié: (2026)
par: Zong, Haotian, et autres
Publié: (2026)
An Epistemic Perspective on Agent Awareness
par: Naumov, Pavel, et autres
Publié: (2025)
par: Naumov, Pavel, et autres
Publié: (2025)
Toward Epistemic Stability: Engineering Consistent Procedures for Industrial LLM Hallucination Reduction
par: Freeman, Brian, et autres
Publié: (2026)
par: Freeman, Brian, et autres
Publié: (2026)
Don't Think Twice! Over-Reasoning Impairs Confidence Calibration
par: Lacombe, Romain, et autres
Publié: (2025)
par: Lacombe, Romain, et autres
Publié: (2025)
Your Pre-trained LLM is Secretly an Unsupervised Confidence Calibrator
par: Luo, Beier, et autres
Publié: (2025)
par: Luo, Beier, et autres
Publié: (2025)
On Epistemic Uncertainty of Visual Tokens for Object Hallucinations in Large Vision-Language Models
par: Seo, Hoigi, et autres
Publié: (2025)
par: Seo, Hoigi, et autres
Publié: (2025)
Modeling Epistemic Uncertainty in Social Perception via Rashomon Set Agents
par: Yang, Jinming, et autres
Publié: (2026)
par: Yang, Jinming, et autres
Publié: (2026)
Mitigating LLM Hallucination via Behaviorally Calibrated Reinforcement Learning
par: Wu, Jiayun, et autres
Publié: (2025)
par: Wu, Jiayun, et autres
Publié: (2025)
PassiveQA: A Three-Action Framework for Epistemically Calibrated Question Answering via Supervised Finetuning
par: Baidya, Madhav S
Publié: (2026)
par: Baidya, Madhav S
Publié: (2026)
CALICO: Confident Active Learning with Integrated Calibration
par: Querol, Lorenzo S., et autres
Publié: (2024)
par: Querol, Lorenzo S., et autres
Publié: (2024)
The Silent Scholar Problem: A Probabilistic Framework for Breaking Epistemic Asymmetry in LLM Agents
par: Chong, Zan-Kai, et autres
Publié: (2025)
par: Chong, Zan-Kai, et autres
Publié: (2025)
A Minimal Agent for Automated Theorem Proving
par: Requena, Borja, et autres
Publié: (2026)
par: Requena, Borja, et autres
Publié: (2026)
Fine-grained Approaches for Confidence Calibration of LLMs in Automated Code Revision
par: Lin, Hong Yi, et autres
Publié: (2026)
par: Lin, Hong Yi, et autres
Publié: (2026)
Confidence and Calibration of Activation Oracles for Reliable Interpretation of Language Model Internals
par: Torrielli, Federico, et autres
Publié: (2026)
par: Torrielli, Federico, et autres
Publié: (2026)
Documents similaires
-
Constructive Interpolation and Concept-Based Beth Definability for Description Logics via Sequents
par: Lyon, Tim S., et autres
Publié: (2024) -
Agentic Confidence Calibration
par: Zhang, Jiaxin, et autres
Publié: (2026) -
Belief Filtering for Epistemic Control in Linguistic State Space
par: Dumbrava, Sebastian
Publié: (2025) -
Examining Independence in Ensemble Sentiment Analysis: A Study on the Limits of Large Language Models Using the Condorcet Jury Theorem
par: Lefort, Baptiste, et autres
Publié: (2024) -
12 Angry AI Agents: Evaluating Multi-Agent LLM Decision-Making Through Cinematic Jury Deliberation
par: Ersoz, Ahmet Bahaddin
Publié: (2026)