Rewarding Doubt: A Reinforcement Learning Approach to Calibrated Confidence Expression of Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Bani-Harouni, David, Pellegrini, Chantal, Stangel, Paul, Özsoy, Ege, Zaripova, Kamilia, Navab, Nassir, Keicher, Matthias |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Language Agents for Hypothesis-driven Clinical Decision Making with Reinforcement Learning
di: Bani-Harouni, David, et al.
Pubblicazione: (2025)
di: Bani-Harouni, David, et al.
Pubblicazione: (2025)
EHR2Path: Scalable Modeling of Longitudinal Patient Pathways from Multimodal Electronic Health Records
di: Pellegrini, Chantal, et al.
Pubblicazione: (2025)
di: Pellegrini, Chantal, et al.
Pubblicazione: (2025)
ORacle: Large Vision-Language Models for Knowledge-Guided Holistic OR Domain Modeling
di: Özsoy, Ege, et al.
Pubblicazione: (2024)
di: Özsoy, Ege, et al.
Pubblicazione: (2024)
Specialized Foundation Models for Intelligent Operating Rooms
di: Özsoy, Ege, et al.
Pubblicazione: (2025)
di: Özsoy, Ege, et al.
Pubblicazione: (2025)
RaDialog: A Large Vision-Language Model for Radiology Report Generation and Conversational Assistance
di: Pellegrini, Chantal, et al.
Pubblicazione: (2023)
di: Pellegrini, Chantal, et al.
Pubblicazione: (2023)
PhenoKG: Knowledge Graph-Driven Gene Discovery and Patient Insights from Phenotypes Alone
di: Zaripova, Kamilia, et al.
Pubblicazione: (2025)
di: Zaripova, Kamilia, et al.
Pubblicazione: (2025)
Calibrated Confidence Expression for Radiology Report Generation
di: Bani-Harouni, David, et al.
Pubblicazione: (2026)
di: Bani-Harouni, David, et al.
Pubblicazione: (2026)
MAGDA: Multi-agent guideline-driven diagnostic assistance
di: Bani-Harouni, David, et al.
Pubblicazione: (2024)
di: Bani-Harouni, David, et al.
Pubblicazione: (2024)
Prototype-Based Knowledge Guidance for Fine-Grained Structured Radiology Reporting
di: Pellegrini, Chantal, et al.
Pubblicazione: (2026)
di: Pellegrini, Chantal, et al.
Pubblicazione: (2026)
Knowledge Graph Sparsification for GNN-based Rare Disease Diagnosis
di: Cara, Premt, et al.
Pubblicazione: (2025)
di: Cara, Premt, et al.
Pubblicazione: (2025)
MM-OR: A Large Multimodal Operating Room Dataset for Semantic Understanding of High-Intensity Surgical Environments
di: Özsoy, Ege, et al.
Pubblicazione: (2025)
di: Özsoy, Ege, et al.
Pubblicazione: (2025)
Learning Diagnostic Reasoning for Decision Support in Toxicology
di: Oberländer, Nico, et al.
Pubblicazione: (2026)
di: Oberländer, Nico, et al.
Pubblicazione: (2026)
SpeechCT-CLIP: Distilling Text-Image Knowledge to Speech for Voice-Native Multimodal CT Analysis
di: Buess, Lukas, et al.
Pubblicazione: (2025)
di: Buess, Lukas, et al.
Pubblicazione: (2025)
Location-Free Scene Graph Generation
di: Özsoy, Ege, et al.
Pubblicazione: (2023)
di: Özsoy, Ege, et al.
Pubblicazione: (2023)
EgoExOR: An Ego-Exo-Centric Operating Room Dataset for Surgical Activity Understanding
di: Özsoy, Ege, et al.
Pubblicazione: (2025)
di: Özsoy, Ege, et al.
Pubblicazione: (2025)
PanORama: Multiview Consistent Panoptic Segmentation in Operating Rooms
di: Gürbüz, Tuna, et al.
Pubblicazione: (2026)
di: Gürbüz, Tuna, et al.
Pubblicazione: (2026)
From large language models to multimodal AI: A scoping review on the potential of generative AI in medicine
di: Buess, Lukas, et al.
Pubblicazione: (2025)
di: Buess, Lukas, et al.
Pubblicazione: (2025)
Counterfactual Explanations for Medical Image Classification and Regression using Diffusion Autoencoder
di: Atad, Matan, et al.
Pubblicazione: (2024)
di: Atad, Matan, et al.
Pubblicazione: (2024)
Echoes of Socratic Doubt: Embracing Uncertainty in Calibrated Evidential Reinforcement Learning
di: Stutts, Alex Christopher, et al.
Pubblicazione: (2024)
di: Stutts, Alex Christopher, et al.
Pubblicazione: (2024)
Decoupling Reasoning and Confidence: Resurrecting Calibration in Reinforcement Learning from Verifiable Rewards
di: Ma, Zhengzhao, et al.
Pubblicazione: (2026)
di: Ma, Zhengzhao, et al.
Pubblicazione: (2026)
Dyadic Partnership(DP): A Missing Link Towards Full Autonomy in Medical Robotics
di: Navab, Nassir, et al.
Pubblicazione: (2026)
di: Navab, Nassir, et al.
Pubblicazione: (2026)
Extending Confidence-Based Text2Cypher with Grammar and Schema Aware Filtering
di: Ozsoy, Makbule Gulcin
Pubblicazione: (2026)
di: Ozsoy, Makbule Gulcin
Pubblicazione: (2026)
Distributional Reinforcement Learning on Path-dependent Options
di: Özsoy, Ahmet Umur
Pubblicazione: (2025)
di: Özsoy, Ahmet Umur
Pubblicazione: (2025)
Neural Semantic Map-Learning for Autonomous Vehicles
di: Herb, Markus, et al.
Pubblicazione: (2024)
di: Herb, Markus, et al.
Pubblicazione: (2024)
ProtoFlow: Interpretable and Robust Surgical Workflow Modeling with Learned Dynamic Scene Graph Prototypes
di: Holm, Felix, et al.
Pubblicazione: (2025)
di: Holm, Felix, et al.
Pubblicazione: (2025)
Autonomous Path Planning for Intercostal Robotic Ultrasound Imaging Using Reinforcement Learning
di: Bi, Yuan, et al.
Pubblicazione: (2024)
di: Bi, Yuan, et al.
Pubblicazione: (2024)
Improving Robustness to Out-of-Distribution States in Imitation Learning via Deep Koopman-Boosted Diffusion Policy
di: Huang, Dianye, et al.
Pubblicazione: (2025)
di: Huang, Dianye, et al.
Pubblicazione: (2025)
Confidence Calibration in Large Language Models
di: Michael, Noam, et al.
Pubblicazione: (2026)
di: Michael, Noam, et al.
Pubblicazione: (2026)
Selective Forgetting in Option Calibration: An Operator-Theoretic Gauss-Newton Framework
di: Özsoy, Ahmet Umur
Pubblicazione: (2025)
di: Özsoy, Ahmet Umur
Pubblicazione: (2025)
Shared Doubt: Zero-shot Cross-Lingual Confidence Estimation for Language Models
di: Kyriakou, Athina, et al.
Pubblicazione: (2026)
di: Kyriakou, Athina, et al.
Pubblicazione: (2026)
"QS VA THE REYTINGLARIDA UNIVERSITET OBRO'SINI SHAKLLANTIRISHDA PR TEXNOLOGIYALARINING O'RNI"
di: Zaripova, Dilobarxon
Pubblicazione: (2026)
di: Zaripova, Dilobarxon
Pubblicazione: (2026)
Language-Guided Open-World Anomaly Segmentation
di: Reichard, Klara, et al.
Pubblicazione: (2025)
di: Reichard, Klara, et al.
Pubblicazione: (2025)
PromptVFX: Text-Driven Fields for Open-World 3D Gaussian Animation
di: Kiray, Mert, et al.
Pubblicazione: (2025)
di: Kiray, Mert, et al.
Pubblicazione: (2025)
CAT-SG: A Large Dynamic Scene Graph Dataset for Fine-Grained Understanding of Cataract Surgery
di: Holm, Felix, et al.
Pubblicazione: (2025)
di: Holm, Felix, et al.
Pubblicazione: (2025)
HecVL: Hierarchical Video-Language Pretraining for Zero-shot Surgical Phase Recognition
di: Yuan, Kun, et al.
Pubblicazione: (2024)
di: Yuan, Kun, et al.
Pubblicazione: (2024)
Recognizing Surgical Phases Anywhere: Few-Shot Test-time Adaptation and Task-graph Guided Refinement
di: Yuan, Kun, et al.
Pubblicazione: (2025)
di: Yuan, Kun, et al.
Pubblicazione: (2025)
CliPPER: Contextual Video-Language Pretraining on Long-form Intraoperative Surgical Procedures for Event Recognition
di: Stilz, Florian, et al.
Pubblicazione: (2026)
di: Stilz, Florian, et al.
Pubblicazione: (2026)
HieraSurg: Hierarchy-Aware Diffusion Model for Surgical Video Generation
di: Biagini, Diego, et al.
Pubblicazione: (2025)
di: Biagini, Diego, et al.
Pubblicazione: (2025)
SURGIVID: Annotation-Efficient Surgical Video Object Discovery
di: Köksal, Çağhan, et al.
Pubblicazione: (2024)
di: Köksal, Çağhan, et al.
Pubblicazione: (2024)
Speckle2Self: Self-Supervised Ultrasound Speckle Reduction Without Clean Data
di: Li, Xuesong, et al.
Pubblicazione: (2025)
di: Li, Xuesong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Language Agents for Hypothesis-driven Clinical Decision Making with Reinforcement Learning
di: Bani-Harouni, David, et al.
Pubblicazione: (2025) -
EHR2Path: Scalable Modeling of Longitudinal Patient Pathways from Multimodal Electronic Health Records
di: Pellegrini, Chantal, et al.
Pubblicazione: (2025) -
ORacle: Large Vision-Language Models for Knowledge-Guided Holistic OR Domain Modeling
di: Özsoy, Ege, et al.
Pubblicazione: (2024) -
Specialized Foundation Models for Intelligent Operating Rooms
di: Özsoy, Ege, et al.
Pubblicazione: (2025) -
RaDialog: A Large Vision-Language Model for Radiology Report Generation and Conversational Assistance
di: Pellegrini, Chantal, et al.
Pubblicazione: (2023)