Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences
Fuente:
arXiv
Salvato in:
| Autori principali: | Shrivastava, Vaishnavi, Kumar, Ananya, Liang, Percy |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CAPO: Confidence Aware Preference Optimization Learning for Multilingual Preferences
di: Pokharel, Rhitabrat, et al.
Pubblicazione: (2025)
di: Pokharel, Rhitabrat, et al.
Pubblicazione: (2025)
Judging with Confidence: Calibrating Autoraters to Preference Distributions
di: Li, Zhuohang, et al.
Pubblicazione: (2025)
di: Li, Zhuohang, et al.
Pubblicazione: (2025)
Effectively Steer LLM To Follow Preference via Building Confident Directions
di: Song, Bingqing, et al.
Pubblicazione: (2025)
di: Song, Bingqing, et al.
Pubblicazione: (2025)
CRPO: Confidence-Reward Driven Preference Optimization for Machine Translation
di: Cui, Guofeng, et al.
Pubblicazione: (2025)
di: Cui, Guofeng, et al.
Pubblicazione: (2025)
Direct Confidence Alignment: Aligning Verbalized Confidence with Internal Confidence In Large Language Models
di: Zhang, Glenn, et al.
Pubblicazione: (2025)
di: Zhang, Glenn, et al.
Pubblicazione: (2025)
When Weak LLMs Speak with Confidence, Preference Alignment Gets Stronger
di: Afzali, Amirabbas, et al.
Pubblicazione: (2026)
di: Afzali, Amirabbas, et al.
Pubblicazione: (2026)
CATTO: Balancing Preferences and Confidence in Language Models
di: Parikh, Nisarg, et al.
Pubblicazione: (2026)
di: Parikh, Nisarg, et al.
Pubblicazione: (2026)
Models Know Models Best: Evaluation via Model-Preferred Formats
di: Lee, Joonhak, et al.
Pubblicazione: (2026)
di: Lee, Joonhak, et al.
Pubblicazione: (2026)
Confidence Estimation for Text-to-SQL in Large Language Models
di: Maleki, Sepideh Entezari, et al.
Pubblicazione: (2025)
di: Maleki, Sepideh Entezari, et al.
Pubblicazione: (2025)
ConfPO: Exploiting Policy Model Confidence for Critical Token Selection in Preference Optimization
di: Yoon, Hee Suk, et al.
Pubblicazione: (2025)
di: Yoon, Hee Suk, et al.
Pubblicazione: (2025)
Confidence Under the Hood: An Investigation into the Confidence-Probability Alignment in Large Language Models
di: Kumar, Abhishek, et al.
Pubblicazione: (2024)
di: Kumar, Abhishek, et al.
Pubblicazione: (2024)
MlingConf: A Comprehensive Study of Multilingual Confidence Estimation on Large Language Models
di: Xue, Boyang, et al.
Pubblicazione: (2024)
di: Xue, Boyang, et al.
Pubblicazione: (2024)
MlingConf: A Comprehensive Study of Multilingual Confidence Estimation on Large Language Models
di: Xue, Boyang, et al.
Pubblicazione: (2024)
di: Xue, Boyang, et al.
Pubblicazione: (2024)
Large Language Model Confidence Estimation via Black-Box Access
di: Pedapati, Tejaswini, et al.
Pubblicazione: (2024)
di: Pedapati, Tejaswini, et al.
Pubblicazione: (2024)
A Survey of Confidence Estimation and Calibration in Large Language Models
di: Geng, Jiahui, et al.
Pubblicazione: (2023)
di: Geng, Jiahui, et al.
Pubblicazione: (2023)
When Confidence Misleads: Suffix Anchoring and Anchor-Proximity Confidence Modulation for Diffusion Language Models
di: Park, Jungwon, et al.
Pubblicazione: (2026)
di: Park, Jungwon, et al.
Pubblicazione: (2026)
The First Token Knows: Single-Decode Confidence for Hallucination Detection
di: Gabriel, Mina
Pubblicazione: (2026)
di: Gabriel, Mina
Pubblicazione: (2026)
Trust in One Round: Confidence Estimation for Large Language Models via Structural Signals
di: Yang, Pengyue, et al.
Pubblicazione: (2026)
di: Yang, Pengyue, et al.
Pubblicazione: (2026)
Towards Reliable Medical LLMs: Benchmarking and Enhancing Confidence Estimation of Large Language Models in Medical Consultation
di: Ren, Zhiyao, et al.
Pubblicazione: (2026)
di: Ren, Zhiyao, et al.
Pubblicazione: (2026)
Calibration Is Not Enough: Evaluating Confidence Estimation Under Language Variations
di: Xia, Yuxi, et al.
Pubblicazione: (2026)
di: Xia, Yuxi, et al.
Pubblicazione: (2026)
Multi-Perspective Consistency Enhances Confidence Estimation in Large Language Models
di: Wang, Pei, et al.
Pubblicazione: (2024)
di: Wang, Pei, et al.
Pubblicazione: (2024)
Confidence is Not Competence
di: Sanyal, Debdeep, et al.
Pubblicazione: (2025)
di: Sanyal, Debdeep, et al.
Pubblicazione: (2025)
Confidence over Time: Confidence Calibration with Temporal Logic for Large Language Model Reasoning
di: Mao, Zhenjiang, et al.
Pubblicazione: (2026)
di: Mao, Zhenjiang, et al.
Pubblicazione: (2026)
Confidence in the Reasoning of Large Language Models
di: Pawitan, Yudi, et al.
Pubblicazione: (2024)
di: Pawitan, Yudi, et al.
Pubblicazione: (2024)
Confident in a Confidence Score: Investigating the Sensitivity of Confidence Scores to Supervised Fine-Tuning
di: Flores, Lorenzo Jaime Yu, et al.
Pubblicazione: (2026)
di: Flores, Lorenzo Jaime Yu, et al.
Pubblicazione: (2026)
Diverging Preferences: When do Annotators Disagree and do Models Know?
di: Zhang, Michael JQ, et al.
Pubblicazione: (2024)
di: Zhang, Michael JQ, et al.
Pubblicazione: (2024)
ADVICE: Answer-Dependent Verbalized Confidence Estimation
di: Seo, Ki Jung, et al.
Pubblicazione: (2025)
di: Seo, Ki Jung, et al.
Pubblicazione: (2025)
Confidence Estimation for LLMs in Multi-turn Interactions
di: Zhang, Caiqi, et al.
Pubblicazione: (2026)
di: Zhang, Caiqi, et al.
Pubblicazione: (2026)
Calibrating the Confidence of Large Language Models by Eliciting Fidelity
di: Zhang, Mozhi, et al.
Pubblicazione: (2024)
di: Zhang, Mozhi, et al.
Pubblicazione: (2024)
Self-Aware Knowledge Probing: Evaluating Language Models' Relational Knowledge through Confidence Calibration
di: Kissling, Christopher, et al.
Pubblicazione: (2026)
di: Kissling, Christopher, et al.
Pubblicazione: (2026)
Label-Confidence-Aware Uncertainty Estimation in Natural Language Generation
di: Lin, Qinhong, et al.
Pubblicazione: (2024)
di: Lin, Qinhong, et al.
Pubblicazione: (2024)
Confidence-Based Response Abstinence: Improving LLM Trustworthiness via Activation-Based Uncertainty Estimation
di: Huang, Zhiqi, et al.
Pubblicazione: (2025)
di: Huang, Zhiqi, et al.
Pubblicazione: (2025)
What Large Language Models Know and What People Think They Know
di: Steyvers, Mark, et al.
Pubblicazione: (2024)
di: Steyvers, Mark, et al.
Pubblicazione: (2024)
Fast-Decoding Diffusion Language Models via Progress-Aware Confidence Schedules
di: Mohamed, Amr, et al.
Pubblicazione: (2025)
di: Mohamed, Amr, et al.
Pubblicazione: (2025)
QA-Calibration of Language Model Confidence Scores
di: Manggala, Putra, et al.
Pubblicazione: (2024)
di: Manggala, Putra, et al.
Pubblicazione: (2024)
Confidence Regulation Neurons in Language Models
di: Stolfo, Alessandro, et al.
Pubblicazione: (2024)
di: Stolfo, Alessandro, et al.
Pubblicazione: (2024)
Preference Estimation via Opponent Modeling in Multi-Agent Negotiation
di: Konishi, Yuta, et al.
Pubblicazione: (2026)
di: Konishi, Yuta, et al.
Pubblicazione: (2026)
KnowRL: Teaching Language Models to Know What They Know
di: Kale, Sahil, et al.
Pubblicazione: (2025)
di: Kale, Sahil, et al.
Pubblicazione: (2025)
Early-Exit and Instant Confidence Translation Quality Estimation
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
Confidence Estimation in Automatic Short Answer Grading with LLMs
di: Cong, Longwei, et al.
Pubblicazione: (2026)
di: Cong, Longwei, et al.
Pubblicazione: (2026)
Documenti analoghi
-
CAPO: Confidence Aware Preference Optimization Learning for Multilingual Preferences
di: Pokharel, Rhitabrat, et al.
Pubblicazione: (2025) -
Judging with Confidence: Calibrating Autoraters to Preference Distributions
di: Li, Zhuohang, et al.
Pubblicazione: (2025) -
Effectively Steer LLM To Follow Preference via Building Confident Directions
di: Song, Bingqing, et al.
Pubblicazione: (2025) -
CRPO: Confidence-Reward Driven Preference Optimization for Machine Translation
di: Cui, Guofeng, et al.
Pubblicazione: (2025) -
Direct Confidence Alignment: Aligning Verbalized Confidence with Internal Confidence In Large Language Models
di: Zhang, Glenn, et al.
Pubblicazione: (2025)