Beyond Confidence: The Rhythms of Reasoning in Generative Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Liu, Deyuan, Wang, Zecheng, Qin, Zhanyue, Tu, Zhiying, Chu, Dianhui, Sui, Dianbo |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Mitigating Gender Bias in Code Large Language Models via Model Editing
von: Qin, Zhanyue, et al.
Veröffentlicht: (2024)
von: Qin, Zhanyue, et al.
Veröffentlicht: (2024)
LFTF: Locating First and Then Fine-Tuning for Mitigating Gender Bias in Large Language Models
von: Qin, Zhanyue, et al.
Veröffentlicht: (2025)
von: Qin, Zhanyue, et al.
Veröffentlicht: (2025)
Pruning via Merging: Compressing LLMs via Manifold Alignment Based Layer Merging
von: Liu, Deyuan, et al.
Veröffentlicht: (2024)
von: Liu, Deyuan, et al.
Veröffentlicht: (2024)
Gradients Must Earn Their Influence: Unifying SFT with Generalized Entropic Objectives
von: Wang, Zecheng, et al.
Veröffentlicht: (2026)
von: Wang, Zecheng, et al.
Veröffentlicht: (2026)
Checkpoint Merging via Bayesian Optimization in LLM Pretraining
von: Liu, Deyuan, et al.
Veröffentlicht: (2024)
von: Liu, Deyuan, et al.
Veröffentlicht: (2024)
UNO Arena for Evaluating Sequential Decision-Making Capability of Large Language Models
von: Qin, Zhanyue, et al.
Veröffentlicht: (2024)
von: Qin, Zhanyue, et al.
Veröffentlicht: (2024)
EchoReview: Learning Peer Review from the Echoes of Scientific Citations
von: Zhang, Yinuo, et al.
Veröffentlicht: (2026)
von: Zhang, Yinuo, et al.
Veröffentlicht: (2026)
HBot: A Chatbot for Healthcare Applications in Traditional Chinese Medicine Based on Human Body 3D Visualization
von: Zhang, Bolin, et al.
Veröffentlicht: (2024)
von: Zhang, Bolin, et al.
Veröffentlicht: (2024)
TMGBench: A Systematic Game Benchmark for Evaluating Strategic Reasoning Abilities of LLMs
von: Wang, Haochuan, et al.
Veröffentlicht: (2024)
von: Wang, Haochuan, et al.
Veröffentlicht: (2024)
Reasoning Models Better Express Their Confidence
von: Yoon, Dongkeun, et al.
Veröffentlicht: (2025)
von: Yoon, Dongkeun, et al.
Veröffentlicht: (2025)
Confidence-Calibrated Small-Large Language Model Collaboration for Cost-Efficient Reasoning
von: Zhang, Chuang, et al.
Veröffentlicht: (2026)
von: Zhang, Chuang, et al.
Veröffentlicht: (2026)
Filtered Reasoning Score: Evaluating Reasoning Quality on a Model's Most-Confident Traces
von: Pathak, Manas, et al.
Veröffentlicht: (2026)
von: Pathak, Manas, et al.
Veröffentlicht: (2026)
Large Language Models for Planning: A Comprehensive and Systematic Survey
von: Cao, Pengfei, et al.
Veröffentlicht: (2025)
von: Cao, Pengfei, et al.
Veröffentlicht: (2025)
ScEdit: Script-based Assessment of Knowledge Editing
von: Li, Xinye, et al.
Veröffentlicht: (2025)
von: Li, Xinye, et al.
Veröffentlicht: (2025)
Beyond Completion: A Foundation Model for General Knowledge Graph Reasoning
von: Hua, Yin, et al.
Veröffentlicht: (2025)
von: Hua, Yin, et al.
Veröffentlicht: (2025)
CodeUnlearn: Amortized Zero-Shot Machine Unlearning in Language Models Using Discrete Concept
von: Wu, YuXuan, et al.
Veröffentlicht: (2024)
von: Wu, YuXuan, et al.
Veröffentlicht: (2024)
TimeBench: A Comprehensive Evaluation of Temporal Reasoning Abilities in Large Language Models
von: Chu, Zheng, et al.
Veröffentlicht: (2023)
von: Chu, Zheng, et al.
Veröffentlicht: (2023)
The Confidence Shortcut: A Reasoning Failure Mode of Masked Diffusion Models
von: Kim, Dueun, et al.
Veröffentlicht: (2026)
von: Kim, Dueun, et al.
Veröffentlicht: (2026)
BayesAgent: Bayesian Agentic Reasoning Under Uncertainty via Verbalized Probabilistic Graphical Modeling
von: Huang, Hengguan, et al.
Veröffentlicht: (2024)
von: Huang, Hengguan, et al.
Veröffentlicht: (2024)
Beyond LLMs: Advancing the Landscape of Complex Reasoning
von: Chu-Carroll, Jennifer, et al.
Veröffentlicht: (2024)
von: Chu-Carroll, Jennifer, et al.
Veröffentlicht: (2024)
FiDeLiS: Faithful Reasoning in Large Language Model for Knowledge Graph Question Answering
von: Sui, Yuan, et al.
Veröffentlicht: (2024)
von: Sui, Yuan, et al.
Veröffentlicht: (2024)
Trade-offs in Large Reasoning Models: An Empirical Analysis of Deliberative and Adaptive Reasoning over Foundational Capabilities
von: Zhao, Weixiang, et al.
Veröffentlicht: (2025)
von: Zhao, Weixiang, et al.
Veröffentlicht: (2025)
Calibrating Verbalized Confidence with Self-Generated Distractors
von: Wang, Victor, et al.
Veröffentlicht: (2025)
von: Wang, Victor, et al.
Veröffentlicht: (2025)
AdaptiveStep: Automatically Dividing Reasoning Step through Model Confidence
von: Liu, Yuliang, et al.
Veröffentlicht: (2025)
von: Liu, Yuliang, et al.
Veröffentlicht: (2025)
PACR: Progressively Ascending Confidence Reward for LLM Reasoning
von: Yoon, Eunseop, et al.
Veröffentlicht: (2025)
von: Yoon, Eunseop, et al.
Veröffentlicht: (2025)
The Role of Model Confidence on Bias Effects in Measured Uncertainties for Vision-Language Models
von: Liu, Xinyi, et al.
Veröffentlicht: (2025)
von: Liu, Xinyi, et al.
Veröffentlicht: (2025)
ConfSpec: Efficient Step-Level Speculative Reasoning via Confidence-Gated Verification
von: Liu, Siran, et al.
Veröffentlicht: (2026)
von: Liu, Siran, et al.
Veröffentlicht: (2026)
Confident or Seek Stronger: Exploring Uncertainty-Based On-device LLM Routing From Benchmarking to Generalization
von: Chuang, Yu-Neng, et al.
Veröffentlicht: (2025)
von: Chuang, Yu-Neng, et al.
Veröffentlicht: (2025)
LLMs Reading the Rhythms of Daily Life: Aligned Understanding for Behavior Prediction and Generation
von: Meng, Fanjin, et al.
Veröffentlicht: (2026)
von: Meng, Fanjin, et al.
Veröffentlicht: (2026)
Brainstorming Brings Power to Large Language Models of Knowledge Reasoning
von: Qin, Zining, et al.
Veröffentlicht: (2024)
von: Qin, Zining, et al.
Veröffentlicht: (2024)
Planning Beyond Text: Graph-based Reasoning for Complex Narrative Generation
von: Gu, Hanwen, et al.
Veröffentlicht: (2026)
von: Gu, Hanwen, et al.
Veröffentlicht: (2026)
MemLong: Memory-Augmented Retrieval for Long Text Modeling
von: Liu, Weijie, et al.
Veröffentlicht: (2024)
von: Liu, Weijie, et al.
Veröffentlicht: (2024)
Leaps Beyond the Seen: Reinforced Reasoning Augmented Generation for Clinical Notes
von: Ting, Lo Pang-Yun, et al.
Veröffentlicht: (2025)
von: Ting, Lo Pang-Yun, et al.
Veröffentlicht: (2025)
MemReread: Enhancing Agentic Long-Context Reasoning via Memory-Guided Rereading
von: Ji, Baibei, et al.
Veröffentlicht: (2026)
von: Ji, Baibei, et al.
Veröffentlicht: (2026)
Double-Calibration: Towards Reliable LLMs via Calibrating Knowledge and Reasoning Confidence
von: Lu, Yuyin, et al.
Veröffentlicht: (2026)
von: Lu, Yuyin, et al.
Veröffentlicht: (2026)
A Survey on Data Selection for LLM Instruction Tuning
von: Zhang, Bolin, et al.
Veröffentlicht: (2024)
von: Zhang, Bolin, et al.
Veröffentlicht: (2024)
Thinking by Subtraction: Confidence-Driven Contrastive Decoding for LLM Reasoning
von: Tang, Lexiang, et al.
Veröffentlicht: (2026)
von: Tang, Lexiang, et al.
Veröffentlicht: (2026)
Don't Think Twice! Over-Reasoning Impairs Confidence Calibration
von: Lacombe, Romain, et al.
Veröffentlicht: (2025)
von: Lacombe, Romain, et al.
Veröffentlicht: (2025)
Confidence-guided Refinement Reasoning for Zero-shot Question Answering
von: Jang, Youwon, et al.
Veröffentlicht: (2025)
von: Jang, Youwon, et al.
Veröffentlicht: (2025)
PiCSAR: Probabilistic Confidence Selection And Ranking for Reasoning Chains
von: Leang, Joshua Ong Jun, et al.
Veröffentlicht: (2025)
von: Leang, Joshua Ong Jun, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Mitigating Gender Bias in Code Large Language Models via Model Editing
von: Qin, Zhanyue, et al.
Veröffentlicht: (2024) -
LFTF: Locating First and Then Fine-Tuning for Mitigating Gender Bias in Large Language Models
von: Qin, Zhanyue, et al.
Veröffentlicht: (2025) -
Pruning via Merging: Compressing LLMs via Manifold Alignment Based Layer Merging
von: Liu, Deyuan, et al.
Veröffentlicht: (2024) -
Gradients Must Earn Their Influence: Unifying SFT with Generalized Entropic Objectives
von: Wang, Zecheng, et al.
Veröffentlicht: (2026) -
Checkpoint Merging via Bayesian Optimization in LLM Pretraining
von: Liu, Deyuan, et al.
Veröffentlicht: (2024)