Confidence in the Reasoning of Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Pawitan, Yudi, Holmes, Chris |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Self-Training Large Language Models with Confident Reasoning
por: Jang, Hyosoon, et al.
Publicado: (2025)
por: Jang, Hyosoon, et al.
Publicado: (2025)
Confidence over Time: Confidence Calibration with Temporal Logic for Large Language Model Reasoning
por: Mao, Zhenjiang, et al.
Publicado: (2026)
por: Mao, Zhenjiang, et al.
Publicado: (2026)
Confidence Geometry Reveals Trace-Level Correctness in Large Language Model Reasoning
por: Liu, Shuo, et al.
Publicado: (2026)
por: Liu, Shuo, et al.
Publicado: (2026)
Confidence Calibration in Large Language Model-Based Entity Matching
por: Kamsteeg, Iris, et al.
Publicado: (2025)
por: Kamsteeg, Iris, et al.
Publicado: (2025)
CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models
por: Li, Shuozhe, et al.
Publicado: (2026)
por: Li, Shuozhe, et al.
Publicado: (2026)
On Subjective Uncertainty Quantification and Calibration in Natural Language Generation
por: Wang, Ziyu, et al.
Publicado: (2024)
por: Wang, Ziyu, et al.
Publicado: (2024)
Generating with Confidence: Uncertainty Quantification for Black-box Large Language Models
por: Lin, Zhen, et al.
Publicado: (2023)
por: Lin, Zhen, et al.
Publicado: (2023)
ORCE: Order-Aware Alignment of Verbalized Confidence in Large Language Models
por: Li, Chen, et al.
Publicado: (2026)
por: Li, Chen, et al.
Publicado: (2026)
Self-ensemble: Mitigating Confidence Mis-calibration for Large Language Models
por: Xu, Zicheng, et al.
Publicado: (2025)
por: Xu, Zicheng, et al.
Publicado: (2025)
Early Stopping for Large Reasoning Models via Confidence Dynamics
por: Hosseini, Parsa, et al.
Publicado: (2026)
por: Hosseini, Parsa, et al.
Publicado: (2026)
Confidence Under the Hood: An Investigation into the Confidence-Probability Alignment in Large Language Models
por: Kumar, Abhishek, et al.
Publicado: (2024)
por: Kumar, Abhishek, et al.
Publicado: (2024)
Recurrent Confidence Chain: Temporal-Aware Uncertainty Quantification in Large Language Models
por: Mao, Zhenjiang, et al.
Publicado: (2026)
por: Mao, Zhenjiang, et al.
Publicado: (2026)
Confidence-Modulated Speculative Decoding for Large Language Models
por: Sen, Jaydip, et al.
Publicado: (2025)
por: Sen, Jaydip, et al.
Publicado: (2025)
A Context-Aware Dual-Metric Framework for Confidence Estimation in Large Language Models
por: Yuan, Mingruo, et al.
Publicado: (2025)
por: Yuan, Mingruo, et al.
Publicado: (2025)
Trust in One Round: Confidence Estimation for Large Language Models via Structural Signals
por: Yang, Pengyue, et al.
Publicado: (2026)
por: Yang, Pengyue, et al.
Publicado: (2026)
QA-Calibration of Language Model Confidence Scores
por: Manggala, Putra, et al.
Publicado: (2024)
por: Manggala, Putra, et al.
Publicado: (2024)
Out-of-Context Reasoning in Large Language Models
por: Shaki, Jonathan, et al.
Publicado: (2025)
por: Shaki, Jonathan, et al.
Publicado: (2025)
Large Language Model Confidence Estimation via Black-Box Access
por: Pedapati, Tejaswini, et al.
Publicado: (2024)
por: Pedapati, Tejaswini, et al.
Publicado: (2024)
Confidence Elicitation: A New Attack Vector for Large Language Models
por: Formento, Brian, et al.
Publicado: (2025)
por: Formento, Brian, et al.
Publicado: (2025)
Benchmarking Large Language Models for Math Reasoning Tasks
por: Seßler, Kathrin, et al.
Publicado: (2024)
por: Seßler, Kathrin, et al.
Publicado: (2024)
Process Supervision of Confidence Margin for Calibrated LLM Reasoning
por: Wang, Liaoyaqi, et al.
Publicado: (2026)
por: Wang, Liaoyaqi, et al.
Publicado: (2026)
Beyond Language: Format-Agnostic Reasoning Subspaces in Large Language Models
por: Yuan, Aojie, et al.
Publicado: (2026)
por: Yuan, Aojie, et al.
Publicado: (2026)
Uncertainty Distillation: Teaching Language Models to Express Semantic Confidence
por: Hager, Sophia, et al.
Publicado: (2025)
por: Hager, Sophia, et al.
Publicado: (2025)
Graph-based Confidence Calibration for Large Language Models
por: Li, Yukun, et al.
Publicado: (2024)
por: Li, Yukun, et al.
Publicado: (2024)
Confidence-Aware Sub-Structure Beam Search (CABS): Mitigating Hallucination in Structured Data Generation with Large Language Models
por: Wei, Chengwei, et al.
Publicado: (2024)
por: Wei, Chengwei, et al.
Publicado: (2024)
Graph Linearization Methods for Reasoning on Graphs with Large Language Models
por: Xypolopoulos, Christos, et al.
Publicado: (2024)
por: Xypolopoulos, Christos, et al.
Publicado: (2024)
Testing Uncertainty of Large Language Models for Physics Knowledge and Reasoning
por: Reganova, Elizaveta, et al.
Publicado: (2024)
por: Reganova, Elizaveta, et al.
Publicado: (2024)
Procedural Knowledge in Pretraining Drives Reasoning in Large Language Models
por: Ruis, Laura, et al.
Publicado: (2024)
por: Ruis, Laura, et al.
Publicado: (2024)
FERA: Uncertainty-Aware Federated Reasoning for Large Language Models
por: Wang, Ruhan, et al.
Publicado: (2026)
por: Wang, Ruhan, et al.
Publicado: (2026)
Progressive-Hint Prompting Improves Reasoning in Large Language Models
por: Zheng, Chuanyang, et al.
Publicado: (2023)
por: Zheng, Chuanyang, et al.
Publicado: (2023)
FOReCAst: The Future Outcome Reasoning and Confidence Assessment Benchmark
por: Yuan, Zhangdie, et al.
Publicado: (2025)
por: Yuan, Zhangdie, et al.
Publicado: (2025)
Confidence Regulation Neurons in Language Models
por: Stolfo, Alessandro, et al.
Publicado: (2024)
por: Stolfo, Alessandro, et al.
Publicado: (2024)
Priority Sampling of Large Language Models for Compilers
por: Grubisic, Dejan, et al.
Publicado: (2024)
por: Grubisic, Dejan, et al.
Publicado: (2024)
Large Language and Reasoning Models are Shallow Disjunctive Reasoners
por: Khalid, Irtaza, et al.
Publicado: (2025)
por: Khalid, Irtaza, et al.
Publicado: (2025)
Assessing Dialect Fairness and Robustness of Large Language Models in Reasoning Tasks
por: Lin, Fangru, et al.
Publicado: (2024)
por: Lin, Fangru, et al.
Publicado: (2024)
metabench -- A Sparse Benchmark of Reasoning and Knowledge in Large Language Models
por: Kipnis, Alex, et al.
Publicado: (2024)
por: Kipnis, Alex, et al.
Publicado: (2024)
A Critical Review of Causal Reasoning Benchmarks for Large Language Models
por: Yang, Linying, et al.
Publicado: (2024)
por: Yang, Linying, et al.
Publicado: (2024)
DynaAct: Large Language Model Reasoning with Dynamic Action Spaces
por: Zhao, Xueliang, et al.
Publicado: (2025)
por: Zhao, Xueliang, et al.
Publicado: (2025)
Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models
por: Zhao, Siyan, et al.
Publicado: (2026)
por: Zhao, Siyan, et al.
Publicado: (2026)
Large Language Model Reasoning Failures
por: Song, Peiyang, et al.
Publicado: (2026)
por: Song, Peiyang, et al.
Publicado: (2026)
Ejemplares similares
-
Self-Training Large Language Models with Confident Reasoning
por: Jang, Hyosoon, et al.
Publicado: (2025) -
Confidence over Time: Confidence Calibration with Temporal Logic for Large Language Model Reasoning
por: Mao, Zhenjiang, et al.
Publicado: (2026) -
Confidence Geometry Reveals Trace-Level Correctness in Large Language Model Reasoning
por: Liu, Shuo, et al.
Publicado: (2026) -
Confidence Calibration in Large Language Model-Based Entity Matching
por: Kamsteeg, Iris, et al.
Publicado: (2025) -
CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models
por: Li, Shuozhe, et al.
Publicado: (2026)