Human-Alignment and Calibration of Inference-Time Uncertainty in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Moore, Kyle, Roberts, Jesse, Watson, Daryl |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Investigating Human-Aligned Large Language Model Uncertainty
por: Moore, Kyle, et al.
Publicado: (2025)
por: Moore, Kyle, et al.
Publicado: (2025)
Large Language Model Recall Uncertainty is Modulated by the Fan Effect
por: Roberts, Jesse, et al.
Publicado: (2024)
por: Roberts, Jesse, et al.
Publicado: (2024)
Do Large Language Models Learn Human-Like Strategic Preferences?
por: Roberts, Jesse, et al.
Publicado: (2024)
por: Roberts, Jesse, et al.
Publicado: (2024)
Chain of Thought Still Thinks Fast: APriCoT Helps with Thinking Slow
por: Moore, Kyle, et al.
Publicado: (2024)
por: Moore, Kyle, et al.
Publicado: (2024)
The Base-Rate Effect on LLM Benchmark Performance: Disambiguating Test-Taking Strategies from Benchmark Performance
por: Moore, Kyle, et al.
Publicado: (2024)
por: Moore, Kyle, et al.
Publicado: (2024)
Revisiting Uncertainty Estimation and Calibration of Large Language Models
por: Tao, Linwei, et al.
Publicado: (2025)
por: Tao, Linwei, et al.
Publicado: (2025)
Knowledge of Knowledge: Exploring Known-Unknowns Uncertainty with Large Language Models
por: Amayuelas, Alfonso, et al.
Publicado: (2023)
por: Amayuelas, Alfonso, et al.
Publicado: (2023)
Inference-Time Language Model Alignment via Integrated Value Guidance
por: Liu, Zhixuan, et al.
Publicado: (2024)
por: Liu, Zhixuan, et al.
Publicado: (2024)
Can Large Language Models Express Uncertainty Like Human?
por: Tao, Linwei, et al.
Publicado: (2025)
por: Tao, Linwei, et al.
Publicado: (2025)
Inference-Aware Prompt Optimization for Aligning Black-Box Large Language Models
por: Mahmud, Saaduddin, et al.
Publicado: (2025)
por: Mahmud, Saaduddin, et al.
Publicado: (2025)
SLMEval: Entropy-Based Calibration for Human-Aligned Evaluation of Large Language Models
por: Daynauth, Roland, et al.
Publicado: (2025)
por: Daynauth, Roland, et al.
Publicado: (2025)
Diverse Human Value Alignment for Large Language Models via Ethical Reasoning
por: Wang, Jiahao, et al.
Publicado: (2025)
por: Wang, Jiahao, et al.
Publicado: (2025)
The Knowledge Alignment Problem: Bridging Human and External Knowledge for Large Language Models
por: Zhang, Shuo, et al.
Publicado: (2023)
por: Zhang, Shuo, et al.
Publicado: (2023)
Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning
por: Krishnan, Ranganath, et al.
Publicado: (2024)
por: Krishnan, Ranganath, et al.
Publicado: (2024)
How Confident Is the First Token? An Uncertainty-Calibrated Prompt Optimization Framework for Large Language Model Classification and Understanding
por: Chen, Wei, et al.
Publicado: (2026)
por: Chen, Wei, et al.
Publicado: (2026)
Calibrating Verbalized Probabilities for Large Language Models
por: Wang, Cheng, et al.
Publicado: (2024)
por: Wang, Cheng, et al.
Publicado: (2024)
Credence Calibration Game? Calibrating Large Language Models through Structured Play
por: Fang, Ke, et al.
Publicado: (2025)
por: Fang, Ke, et al.
Publicado: (2025)
Human-Calibrated Automated Testing and Validation of Generative Language Models
por: Sudjianto, Agus, et al.
Publicado: (2024)
por: Sudjianto, Agus, et al.
Publicado: (2024)
Uncertainty in Language Models: Assessment through Rank-Calibration
por: Huang, Xinmeng, et al.
Publicado: (2024)
por: Huang, Xinmeng, et al.
Publicado: (2024)
Experimental Contexts Can Facilitate Robust Semantic Property Inference in Language Models, but Inconsistently
por: Misra, Kanishka, et al.
Publicado: (2024)
por: Misra, Kanishka, et al.
Publicado: (2024)
An Assessment of Human vs. Model Uncertainty in Soft-Label Learning and Calibration
por: Pavlovic, Maja, et al.
Publicado: (2026)
por: Pavlovic, Maja, et al.
Publicado: (2026)
Fundamental Limitations of Alignment in Large Language Models
por: Wolf, Yotam, et al.
Publicado: (2023)
por: Wolf, Yotam, et al.
Publicado: (2023)
Benchmarking Distributional Alignment of Large Language Models
por: Meister, Nicole, et al.
Publicado: (2024)
por: Meister, Nicole, et al.
Publicado: (2024)
Dropouts in Confidence: Moral Uncertainty in Human-LLM Alignment
por: Kwon, Jea, et al.
Publicado: (2025)
por: Kwon, Jea, et al.
Publicado: (2025)
Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time
por: Chehade, Mohamad, et al.
Publicado: (2025)
por: Chehade, Mohamad, et al.
Publicado: (2025)
IIMedGPT: Promoting Large Language Model Capabilities of Medical Tasks by Efficient Human Preference Alignment
por: Zhang, Yiming, et al.
Publicado: (2025)
por: Zhang, Yiming, et al.
Publicado: (2025)
SEAL: Steerable Reasoning Calibration of Large Language Models for Free
por: Chen, Runjin, et al.
Publicado: (2025)
por: Chen, Runjin, et al.
Publicado: (2025)
A Survey of Confidence Estimation and Calibration in Large Language Models
por: Geng, Jiahui, et al.
Publicado: (2023)
por: Geng, Jiahui, et al.
Publicado: (2023)
Don't Forget Your Reward Values: Language Model Alignment via Value-based Calibration
por: Mao, Xin, et al.
Publicado: (2024)
por: Mao, Xin, et al.
Publicado: (2024)
Basic Category Usage in Vision Language Models
por: Sawyer, Hunter, et al.
Publicado: (2025)
por: Sawyer, Hunter, et al.
Publicado: (2025)
An Empirical Analysis of Uncertainty in Large Language Model Evaluations
por: Xie, Qiujie, et al.
Publicado: (2025)
por: Xie, Qiujie, et al.
Publicado: (2025)
Unlocking the Power of Large Language Models for Entity Alignment
por: Jiang, Xuhui, et al.
Publicado: (2024)
por: Jiang, Xuhui, et al.
Publicado: (2024)
Progressively Label Enhancement for Large Language Model Alignment
por: Liu, Biao, et al.
Publicado: (2024)
por: Liu, Biao, et al.
Publicado: (2024)
Cultural Bias and Cultural Alignment of Large Language Models
por: Tao, Yan, et al.
Publicado: (2023)
por: Tao, Yan, et al.
Publicado: (2023)
FLAME: Factuality-Aware Alignment for Large Language Models
por: Lin, Sheng-Chieh, et al.
Publicado: (2024)
por: Lin, Sheng-Chieh, et al.
Publicado: (2024)
LLMs as Agentic Cooperative Players in Multiplayer UNO
por: Matinez, Yago Romano, et al.
Publicado: (2025)
por: Matinez, Yago Romano, et al.
Publicado: (2025)
Beyond Accuracy: The Role of Calibration in Self-Improving Large Language Models
por: Huang, Liangjie, et al.
Publicado: (2025)
por: Huang, Liangjie, et al.
Publicado: (2025)
LACIE: Listener-Aware Finetuning for Confidence Calibration in Large Language Models
por: Stengel-Eskin, Elias, et al.
Publicado: (2024)
por: Stengel-Eskin, Elias, et al.
Publicado: (2024)
Unplug and Play Language Models: Decomposing Experts in Language Models at Inference Time
por: Yang, Nakyeong, et al.
Publicado: (2024)
por: Yang, Nakyeong, et al.
Publicado: (2024)
Are Large Language Models Consistent over Value-laden Questions?
por: Moore, Jared, et al.
Publicado: (2024)
por: Moore, Jared, et al.
Publicado: (2024)
Ejemplares similares
-
Investigating Human-Aligned Large Language Model Uncertainty
por: Moore, Kyle, et al.
Publicado: (2025) -
Large Language Model Recall Uncertainty is Modulated by the Fan Effect
por: Roberts, Jesse, et al.
Publicado: (2024) -
Do Large Language Models Learn Human-Like Strategic Preferences?
por: Roberts, Jesse, et al.
Publicado: (2024) -
Chain of Thought Still Thinks Fast: APriCoT Helps with Thinking Slow
por: Moore, Kyle, et al.
Publicado: (2024) -
The Base-Rate Effect on LLM Benchmark Performance: Disambiguating Test-Taking Strategies from Benchmark Performance
por: Moore, Kyle, et al.
Publicado: (2024)