Balancing Classification and Calibration Performance in Decision-Making LLMs via Calibration Aware Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Yaldiz, Duygu Nur, Spiliopoulou, Evangelia, Qi, Zheng, Varia, Siddharth, Doss, Srikanth, Pappas, Nikolaos |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Capturing Gaze Shifts for Guidance: Cross-Modal Fusion Enhancement for VLM Hallucination Mitigation
di: Qi, Zheng, et al.
Pubblicazione: (2025)
di: Qi, Zheng, et al.
Pubblicazione: (2025)
Robust Decision Making with Partially Calibrated Forecasts
di: Kiyani, Shayan, et al.
Pubblicazione: (2025)
di: Kiyani, Shayan, et al.
Pubblicazione: (2025)
MARS: Meaning-Aware Response Scoring for Uncertainty Estimation in Generative LLMs
di: Bakman, Yavuz Faruk, et al.
Pubblicazione: (2024)
di: Bakman, Yavuz Faruk, et al.
Pubblicazione: (2024)
Inference time LLM alignment in single and multidomain preference spectrum
di: Shahriar, Sadat, et al.
Pubblicazione: (2024)
di: Shahriar, Sadat, et al.
Pubblicazione: (2024)
Efficient Calibration for Decision Making
di: Gopalan, Parikshit, et al.
Pubblicazione: (2025)
di: Gopalan, Parikshit, et al.
Pubblicazione: (2025)
Calibration Error for Decision Making
di: Hu, Lunjia, et al.
Pubblicazione: (2024)
di: Hu, Lunjia, et al.
Pubblicazione: (2024)
Smooth Calibration and Decision Making
di: Hartline, Jason, et al.
Pubblicazione: (2025)
di: Hartline, Jason, et al.
Pubblicazione: (2025)
Un-considering Contextual Information: Assessing LLMs' Understanding of Indexical Elements
di: Oguz, Metehan, et al.
Pubblicazione: (2025)
di: Oguz, Metehan, et al.
Pubblicazione: (2025)
Hair-Trigger Alignment: Black-Box Evaluation Cannot Guarantee Post-Update Alignment
di: Bakman, Yavuz, et al.
Pubblicazione: (2026)
di: Bakman, Yavuz, et al.
Pubblicazione: (2026)
Clustered Calibration: Representation-Aware Probability Calibration via Learned Subpopulations
di: Lavi, Tomer, et al.
Pubblicazione: (2025)
di: Lavi, Tomer, et al.
Pubblicazione: (2025)
Ranking-Aware Calibration for Reliable Multimodal Reinforcement Learning
di: Cui, Peng, et al.
Pubblicazione: (2026)
di: Cui, Peng, et al.
Pubblicazione: (2026)
Reject Only Critical Tokens: Pivot-Aware Speculative Decoding
di: Ziashahabi, Amir, et al.
Pubblicazione: (2025)
di: Ziashahabi, Amir, et al.
Pubblicazione: (2025)
Conformal Prediction Adaptive to Unknown Subpopulation Shifts
di: Wang, Nien-Shao, et al.
Pubblicazione: (2025)
di: Wang, Nien-Shao, et al.
Pubblicazione: (2025)
Human-Aligned Calibration for AI-Assisted Decision Making
di: Benz, Nina L. Corvelo, et al.
Pubblicazione: (2023)
di: Benz, Nina L. Corvelo, et al.
Pubblicazione: (2023)
Calibration-Aware Policy Optimization for Reasoning LLMs
di: Wang, Ziqi, et al.
Pubblicazione: (2026)
di: Wang, Ziqi, et al.
Pubblicazione: (2026)
Digital Twin Calibration with Model-Based Reinforcement Learning
di: Zheng, Hua, et al.
Pubblicazione: (2025)
di: Zheng, Hua, et al.
Pubblicazione: (2025)
Fairness-Aware Reinforcement Learning (FAReL): A Framework for Transparent and Balanced Sequential Decision-Making
di: Cimpean, Alexandra, et al.
Pubblicazione: (2025)
di: Cimpean, Alexandra, et al.
Pubblicazione: (2025)
Calibration-Aware Bayesian Learning
di: Huang, Jiayi, et al.
Pubblicazione: (2023)
di: Huang, Jiayi, et al.
Pubblicazione: (2023)
Computing the Exact Pareto Front in Average-Cost Multi-Objective Markov Decision Processes
di: Luo, Jiping, et al.
Pubblicazione: (2026)
di: Luo, Jiping, et al.
Pubblicazione: (2026)
Automatic Gradient Estimation for Calibrating Crowd Models with Discrete Decision Making
di: Andelfinger, Philipp, et al.
Pubblicazione: (2024)
di: Andelfinger, Philipp, et al.
Pubblicazione: (2024)
Jailbreaking LLMs via Calibration
di: Lu, Yuxuan, et al.
Pubblicazione: (2026)
di: Lu, Yuxuan, et al.
Pubblicazione: (2026)
Task-Aware Calibration: Provably Optimal Decoding in LLMs
di: Tomov, Tim, et al.
Pubblicazione: (2026)
di: Tomov, Tim, et al.
Pubblicazione: (2026)
Calibrated Selective Classification
di: Fisch, Adam, et al.
Pubblicazione: (2022)
di: Fisch, Adam, et al.
Pubblicazione: (2022)
Semantic-Aware Remote Estimation of Multiple Markov Sources Under Constraints
di: Luo, Jiping, et al.
Pubblicazione: (2024)
di: Luo, Jiping, et al.
Pubblicazione: (2024)
Mitigating LLM Hallucination via Behaviorally Calibrated Reinforcement Learning
di: Wu, Jiayun, et al.
Pubblicazione: (2025)
di: Wu, Jiayun, et al.
Pubblicazione: (2025)
Decoupling Decision-Making in Fraud Prevention through Classifier Calibration for Business Logic Action
di: Luzio, Emanuele, et al.
Pubblicazione: (2024)
di: Luzio, Emanuele, et al.
Pubblicazione: (2024)
Beyond Synthetic Augmentation: Group-Aware Threshold Calibration for Robust Balanced Accuracy in Imbalanced Learning
di: Gittlin, Hunter
Pubblicazione: (2025)
di: Gittlin, Hunter
Pubblicazione: (2025)
Performance Estimation in Binary Classification Using Calibrated Confidence
di: Kivimäki, Juhani, et al.
Pubblicazione: (2025)
di: Kivimäki, Juhani, et al.
Pubblicazione: (2025)
Spatial-Aware Decision-Making with Ring Attractors in Reinforcement Learning Systems
di: Saura, Marcos Negre, et al.
Pubblicazione: (2024)
di: Saura, Marcos Negre, et al.
Pubblicazione: (2024)
Battery-aware Cyclic Scheduling in Energy-harvesting Federated Learning
di: Jeong, Eunjeong, et al.
Pubblicazione: (2025)
di: Jeong, Eunjeong, et al.
Pubblicazione: (2025)
Calibration Across Layers: Understanding Calibration Evolution in LLMs
di: Joshi, Abhinav, et al.
Pubblicazione: (2025)
di: Joshi, Abhinav, et al.
Pubblicazione: (2025)
Truthfulness of Decision-Theoretic Calibration Measures
di: Qiao, Mingda, et al.
Pubblicazione: (2025)
di: Qiao, Mingda, et al.
Pubblicazione: (2025)
Calibration vs Decision Making: Revisiting the Reliability Paradox in Unlearned Language Models
di: Shukla, Divyaksh, et al.
Pubblicazione: (2026)
di: Shukla, Divyaksh, et al.
Pubblicazione: (2026)
Trained on Tokens, Calibrated on Concepts: The Emergence of Semantic Calibration in LLMs
di: Nakkiran, Preetum, et al.
Pubblicazione: (2025)
di: Nakkiran, Preetum, et al.
Pubblicazione: (2025)
Computation-aware Energy-harvesting Federated Learning: Cyclic Scheduling with Selective Participation
di: Jeong, Eunjeong, et al.
Pubblicazione: (2025)
di: Jeong, Eunjeong, et al.
Pubblicazione: (2025)
Calibrating Decision Robustness via Inverse Conformal Risk Control
di: Zhou, Wenbin, et al.
Pubblicazione: (2025)
di: Zhou, Wenbin, et al.
Pubblicazione: (2025)
Bellman Calibration for $V$-Learning in Offline Reinforcement Learning
di: van der Laan, Lars, et al.
Pubblicazione: (2025)
di: van der Laan, Lars, et al.
Pubblicazione: (2025)
Restoring Calibration for Aligned Large Language Models: A Calibration-Aware Fine-Tuning Approach
di: Xiao, Jiancong, et al.
Pubblicazione: (2025)
di: Xiao, Jiancong, et al.
Pubblicazione: (2025)
Symmetries-enhanced Multi-Agent Reinforcement Learning
di: Bousias, Nikolaos, et al.
Pubblicazione: (2025)
di: Bousias, Nikolaos, et al.
Pubblicazione: (2025)
Calibrating LLMs with Information-Theoretic Evidential Deep Learning
di: Li, Yawei, et al.
Pubblicazione: (2025)
di: Li, Yawei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Capturing Gaze Shifts for Guidance: Cross-Modal Fusion Enhancement for VLM Hallucination Mitigation
di: Qi, Zheng, et al.
Pubblicazione: (2025) -
Robust Decision Making with Partially Calibrated Forecasts
di: Kiyani, Shayan, et al.
Pubblicazione: (2025) -
MARS: Meaning-Aware Response Scoring for Uncertainty Estimation in Generative LLMs
di: Bakman, Yavuz Faruk, et al.
Pubblicazione: (2024) -
Inference time LLM alignment in single and multidomain preference spectrum
di: Shahriar, Sadat, et al.
Pubblicazione: (2024) -
Efficient Calibration for Decision Making
di: Gopalan, Parikshit, et al.
Pubblicazione: (2025)