Confidence in the Reasoning of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pawitan, Yudi, Holmes, Chris |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Self-Training Large Language Models with Confident Reasoning
par: Jang, Hyosoon, et autres
Publié: (2025)
par: Jang, Hyosoon, et autres
Publié: (2025)
Confidence over Time: Confidence Calibration with Temporal Logic for Large Language Model Reasoning
par: Mao, Zhenjiang, et autres
Publié: (2026)
par: Mao, Zhenjiang, et autres
Publié: (2026)
Confidence Geometry Reveals Trace-Level Correctness in Large Language Model Reasoning
par: Liu, Shuo, et autres
Publié: (2026)
par: Liu, Shuo, et autres
Publié: (2026)
Confidence Calibration in Large Language Model-Based Entity Matching
par: Kamsteeg, Iris, et autres
Publié: (2025)
par: Kamsteeg, Iris, et autres
Publié: (2025)
CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models
par: Li, Shuozhe, et autres
Publié: (2026)
par: Li, Shuozhe, et autres
Publié: (2026)
On Subjective Uncertainty Quantification and Calibration in Natural Language Generation
par: Wang, Ziyu, et autres
Publié: (2024)
par: Wang, Ziyu, et autres
Publié: (2024)
Generating with Confidence: Uncertainty Quantification for Black-box Large Language Models
par: Lin, Zhen, et autres
Publié: (2023)
par: Lin, Zhen, et autres
Publié: (2023)
ORCE: Order-Aware Alignment of Verbalized Confidence in Large Language Models
par: Li, Chen, et autres
Publié: (2026)
par: Li, Chen, et autres
Publié: (2026)
Self-ensemble: Mitigating Confidence Mis-calibration for Large Language Models
par: Xu, Zicheng, et autres
Publié: (2025)
par: Xu, Zicheng, et autres
Publié: (2025)
Early Stopping for Large Reasoning Models via Confidence Dynamics
par: Hosseini, Parsa, et autres
Publié: (2026)
par: Hosseini, Parsa, et autres
Publié: (2026)
Confidence Under the Hood: An Investigation into the Confidence-Probability Alignment in Large Language Models
par: Kumar, Abhishek, et autres
Publié: (2024)
par: Kumar, Abhishek, et autres
Publié: (2024)
Recurrent Confidence Chain: Temporal-Aware Uncertainty Quantification in Large Language Models
par: Mao, Zhenjiang, et autres
Publié: (2026)
par: Mao, Zhenjiang, et autres
Publié: (2026)
Confidence-Modulated Speculative Decoding for Large Language Models
par: Sen, Jaydip, et autres
Publié: (2025)
par: Sen, Jaydip, et autres
Publié: (2025)
A Context-Aware Dual-Metric Framework for Confidence Estimation in Large Language Models
par: Yuan, Mingruo, et autres
Publié: (2025)
par: Yuan, Mingruo, et autres
Publié: (2025)
Trust in One Round: Confidence Estimation for Large Language Models via Structural Signals
par: Yang, Pengyue, et autres
Publié: (2026)
par: Yang, Pengyue, et autres
Publié: (2026)
QA-Calibration of Language Model Confidence Scores
par: Manggala, Putra, et autres
Publié: (2024)
par: Manggala, Putra, et autres
Publié: (2024)
Out-of-Context Reasoning in Large Language Models
par: Shaki, Jonathan, et autres
Publié: (2025)
par: Shaki, Jonathan, et autres
Publié: (2025)
Large Language Model Confidence Estimation via Black-Box Access
par: Pedapati, Tejaswini, et autres
Publié: (2024)
par: Pedapati, Tejaswini, et autres
Publié: (2024)
Confidence Elicitation: A New Attack Vector for Large Language Models
par: Formento, Brian, et autres
Publié: (2025)
par: Formento, Brian, et autres
Publié: (2025)
Benchmarking Large Language Models for Math Reasoning Tasks
par: Seßler, Kathrin, et autres
Publié: (2024)
par: Seßler, Kathrin, et autres
Publié: (2024)
Process Supervision of Confidence Margin for Calibrated LLM Reasoning
par: Wang, Liaoyaqi, et autres
Publié: (2026)
par: Wang, Liaoyaqi, et autres
Publié: (2026)
Beyond Language: Format-Agnostic Reasoning Subspaces in Large Language Models
par: Yuan, Aojie, et autres
Publié: (2026)
par: Yuan, Aojie, et autres
Publié: (2026)
Uncertainty Distillation: Teaching Language Models to Express Semantic Confidence
par: Hager, Sophia, et autres
Publié: (2025)
par: Hager, Sophia, et autres
Publié: (2025)
Graph-based Confidence Calibration for Large Language Models
par: Li, Yukun, et autres
Publié: (2024)
par: Li, Yukun, et autres
Publié: (2024)
Confidence-Aware Sub-Structure Beam Search (CABS): Mitigating Hallucination in Structured Data Generation with Large Language Models
par: Wei, Chengwei, et autres
Publié: (2024)
par: Wei, Chengwei, et autres
Publié: (2024)
Graph Linearization Methods for Reasoning on Graphs with Large Language Models
par: Xypolopoulos, Christos, et autres
Publié: (2024)
par: Xypolopoulos, Christos, et autres
Publié: (2024)
Testing Uncertainty of Large Language Models for Physics Knowledge and Reasoning
par: Reganova, Elizaveta, et autres
Publié: (2024)
par: Reganova, Elizaveta, et autres
Publié: (2024)
Procedural Knowledge in Pretraining Drives Reasoning in Large Language Models
par: Ruis, Laura, et autres
Publié: (2024)
par: Ruis, Laura, et autres
Publié: (2024)
FERA: Uncertainty-Aware Federated Reasoning for Large Language Models
par: Wang, Ruhan, et autres
Publié: (2026)
par: Wang, Ruhan, et autres
Publié: (2026)
Progressive-Hint Prompting Improves Reasoning in Large Language Models
par: Zheng, Chuanyang, et autres
Publié: (2023)
par: Zheng, Chuanyang, et autres
Publié: (2023)
FOReCAst: The Future Outcome Reasoning and Confidence Assessment Benchmark
par: Yuan, Zhangdie, et autres
Publié: (2025)
par: Yuan, Zhangdie, et autres
Publié: (2025)
Confidence Regulation Neurons in Language Models
par: Stolfo, Alessandro, et autres
Publié: (2024)
par: Stolfo, Alessandro, et autres
Publié: (2024)
Priority Sampling of Large Language Models for Compilers
par: Grubisic, Dejan, et autres
Publié: (2024)
par: Grubisic, Dejan, et autres
Publié: (2024)
Large Language and Reasoning Models are Shallow Disjunctive Reasoners
par: Khalid, Irtaza, et autres
Publié: (2025)
par: Khalid, Irtaza, et autres
Publié: (2025)
Assessing Dialect Fairness and Robustness of Large Language Models in Reasoning Tasks
par: Lin, Fangru, et autres
Publié: (2024)
par: Lin, Fangru, et autres
Publié: (2024)
metabench -- A Sparse Benchmark of Reasoning and Knowledge in Large Language Models
par: Kipnis, Alex, et autres
Publié: (2024)
par: Kipnis, Alex, et autres
Publié: (2024)
A Critical Review of Causal Reasoning Benchmarks for Large Language Models
par: Yang, Linying, et autres
Publié: (2024)
par: Yang, Linying, et autres
Publié: (2024)
DynaAct: Large Language Model Reasoning with Dynamic Action Spaces
par: Zhao, Xueliang, et autres
Publié: (2025)
par: Zhao, Xueliang, et autres
Publié: (2025)
Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models
par: Zhao, Siyan, et autres
Publié: (2026)
par: Zhao, Siyan, et autres
Publié: (2026)
Large Language Model Reasoning Failures
par: Song, Peiyang, et autres
Publié: (2026)
par: Song, Peiyang, et autres
Publié: (2026)
Documents similaires
-
Self-Training Large Language Models with Confident Reasoning
par: Jang, Hyosoon, et autres
Publié: (2025) -
Confidence over Time: Confidence Calibration with Temporal Logic for Large Language Model Reasoning
par: Mao, Zhenjiang, et autres
Publié: (2026) -
Confidence Geometry Reveals Trace-Level Correctness in Large Language Model Reasoning
par: Liu, Shuo, et autres
Publié: (2026) -
Confidence Calibration in Large Language Model-Based Entity Matching
par: Kamsteeg, Iris, et autres
Publié: (2025) -
CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models
par: Li, Shuozhe, et autres
Publié: (2026)