Self-Training Large Language Models with Confident Reasoning
Fuente:
arXiv
Saved in:
| Main Authors: | Jang, Hyosoon, Jang, Yunhui, Lee, Sungjae, Ok, Jungseul, Ahn, Sungsoo |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Can LLMs Generate Diverse Molecules? Towards Alignment with Structural Diversity
by: Jang, Hyosoon, et al.
Published: (2024)
by: Jang, Hyosoon, et al.
Published: (2024)
Pessimistic Backward Policy for GFlowNets
by: Jang, Hyosoon, et al.
Published: (2024)
by: Jang, Hyosoon, et al.
Published: (2024)
PaT: Planning-after-Trial for Efficient Test-Time Code Generation
by: Yoon, Youngsik, et al.
Published: (2026)
by: Yoon, Youngsik, et al.
Published: (2026)
Structural Reasoning Improves Molecular Understanding of LLM
by: Jang, Yunhui, et al.
Published: (2024)
by: Jang, Yunhui, et al.
Published: (2024)
A Systematic Evaluation of Co-folding Model Representations for Small-Molecule Learning
by: Jang, Hyosoon, et al.
Published: (2026)
by: Jang, Hyosoon, et al.
Published: (2026)
A Simple and Scalable Representation for Graph Generation
by: Jang, Yunhui, et al.
Published: (2023)
by: Jang, Yunhui, et al.
Published: (2023)
Improving Chemical Understanding of LLMs via SMILES Parsing
by: Jang, Yunhui, et al.
Published: (2025)
by: Jang, Yunhui, et al.
Published: (2025)
When Are Experts Misrouted? Counterfactual Routing Analysis in Mixture-of-Experts Language Models
by: Yoon, Youngsik, et al.
Published: (2026)
by: Yoon, Youngsik, et al.
Published: (2026)
Semantic Exploration with Adaptive Gating for Efficient Problem Solving with Language Models
by: Lee, Sungjae, et al.
Published: (2025)
by: Lee, Sungjae, et al.
Published: (2025)
Graph Generation with $K^2$-trees
by: Jang, Yunhui, et al.
Published: (2023)
by: Jang, Yunhui, et al.
Published: (2023)
Improving Robustness to Multiple Spurious Correlations by Multi-Objective Optimization
by: Kim, Nayeong, et al.
Published: (2024)
by: Kim, Nayeong, et al.
Published: (2024)
Hybrid Neural Representations for Spherical Data
by: Kim, Hyomin, et al.
Published: (2024)
by: Kim, Hyomin, et al.
Published: (2024)
Towards Robust and Efficient Federated Low-Rank Adaptation with Heterogeneous Clients
by: Koo, Jabin, et al.
Published: (2024)
by: Koo, Jabin, et al.
Published: (2024)
Confidence in the Reasoning of Large Language Models
by: Pawitan, Yudi, et al.
Published: (2024)
by: Pawitan, Yudi, et al.
Published: (2024)
Bridging the Gap between Expert and Language Models: Concept-guided Chess Commentary Generation and Evaluation
by: Kim, Jaechang, et al.
Published: (2024)
by: Kim, Jaechang, et al.
Published: (2024)
Confidence over Time: Confidence Calibration with Temporal Logic for Large Language Model Reasoning
by: Mao, Zhenjiang, et al.
Published: (2026)
by: Mao, Zhenjiang, et al.
Published: (2026)
Large Language Models Are Better Logical Fallacy Reasoners with Counterargument, Explanation, and Goal-Aware Prompt Formulation
by: Jeong, Jiwon, et al.
Published: (2025)
by: Jeong, Jiwon, et al.
Published: (2025)
Federated Variational Preference Alignment with Gumbel-Softmax Prior for Personalized User Preferences
by: Koo, Jabin, et al.
Published: (2026)
by: Koo, Jabin, et al.
Published: (2026)
Self-ensemble: Mitigating Confidence Mis-calibration for Large Language Models
by: Xu, Zicheng, et al.
Published: (2025)
by: Xu, Zicheng, et al.
Published: (2025)
Confidence Geometry Reveals Trace-Level Correctness in Large Language Model Reasoning
by: Liu, Shuo, et al.
Published: (2026)
by: Liu, Shuo, et al.
Published: (2026)
Self-Training Elicits Concise Reasoning in Large Language Models
by: Munkhbat, Tergel, et al.
Published: (2025)
by: Munkhbat, Tergel, et al.
Published: (2025)
Revisiting Early Detection of Sexual Predators via Turn-level Optimization
by: An, Jinmyeong, et al.
Published: (2025)
by: An, Jinmyeong, et al.
Published: (2025)
Efficient Latent Semantic Clustering for Scaling Test-Time Computation of LLMs
by: Lee, Sungjae, et al.
Published: (2025)
by: Lee, Sungjae, et al.
Published: (2025)
AdaSTaR: Adaptive Data Sampling for Training Self-Taught Reasoners
by: Koh, Woosung, et al.
Published: (2025)
by: Koh, Woosung, et al.
Published: (2025)
Lost in the Prompt Order: Revealing the Limitations of Causal Attention in Language Models
by: Ok, Hyunjong, et al.
Published: (2026)
by: Ok, Hyunjong, et al.
Published: (2026)
Understanding the Effects of Distractors on Reasoning Vision-Language Models
by: Bae, Jiyun, et al.
Published: (2025)
by: Bae, Jiyun, et al.
Published: (2025)
Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models
by: Zhao, Siyan, et al.
Published: (2026)
by: Zhao, Siyan, et al.
Published: (2026)
AdaptiveStep: Automatically Dividing Reasoning Step through Model Confidence
by: Liu, Yuliang, et al.
Published: (2025)
by: Liu, Yuliang, et al.
Published: (2025)
Confidence Calibration in Large Language Model-Based Entity Matching
by: Kamsteeg, Iris, et al.
Published: (2025)
by: Kamsteeg, Iris, et al.
Published: (2025)
CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models
by: Li, Shuozhe, et al.
Published: (2026)
by: Li, Shuozhe, et al.
Published: (2026)
Enhancing LLM Agent Safety via Causal Influence Prompting
by: Hahm, Dongyoon, et al.
Published: (2025)
by: Hahm, Dongyoon, et al.
Published: (2025)
Training Language Models to Reason Efficiently
by: Arora, Daman, et al.
Published: (2025)
by: Arora, Daman, et al.
Published: (2025)
Generating with Confidence: Uncertainty Quantification for Black-box Large Language Models
by: Lin, Zhen, et al.
Published: (2023)
by: Lin, Zhen, et al.
Published: (2023)
ORCE: Order-Aware Alignment of Verbalized Confidence in Large Language Models
by: Li, Chen, et al.
Published: (2026)
by: Li, Chen, et al.
Published: (2026)
Early Stopping for Large Reasoning Models via Confidence Dynamics
by: Hosseini, Parsa, et al.
Published: (2026)
by: Hosseini, Parsa, et al.
Published: (2026)
Confidence Under the Hood: An Investigation into the Confidence-Probability Alignment in Large Language Models
by: Kumar, Abhishek, et al.
Published: (2024)
by: Kumar, Abhishek, et al.
Published: (2024)
Compressed Context Memory For Online Language Model Interaction
by: Kim, Jang-Hyun, et al.
Published: (2023)
by: Kim, Jang-Hyun, et al.
Published: (2023)
Recurrent Confidence Chain: Temporal-Aware Uncertainty Quantification in Large Language Models
by: Mao, Zhenjiang, et al.
Published: (2026)
by: Mao, Zhenjiang, et al.
Published: (2026)
Confidence-Modulated Speculative Decoding for Large Language Models
by: Sen, Jaydip, et al.
Published: (2025)
by: Sen, Jaydip, et al.
Published: (2025)
A Context-Aware Dual-Metric Framework for Confidence Estimation in Large Language Models
by: Yuan, Mingruo, et al.
Published: (2025)
by: Yuan, Mingruo, et al.
Published: (2025)
Similar Items
-
Can LLMs Generate Diverse Molecules? Towards Alignment with Structural Diversity
by: Jang, Hyosoon, et al.
Published: (2024) -
Pessimistic Backward Policy for GFlowNets
by: Jang, Hyosoon, et al.
Published: (2024) -
PaT: Planning-after-Trial for Efficient Test-Time Code Generation
by: Yoon, Youngsik, et al.
Published: (2026) -
Structural Reasoning Improves Molecular Understanding of LLM
by: Jang, Yunhui, et al.
Published: (2024) -
A Systematic Evaluation of Co-folding Model Representations for Small-Molecule Learning
by: Jang, Hyosoon, et al.
Published: (2026)