Process Supervision via Verbal Critique Improves Reasoning in Large Language Models
Fuente:
arXiv
Guardado en:
| Autor principal: | Chen, Hao-Yuan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Verbal Process Supervision Elicits Better Coding Agents
por: Chen, Hao-Yuan, et al.
Publicado: (2025)
por: Chen, Hao-Yuan, et al.
Publicado: (2025)
RefineCoder: Iterative Improving of Large Language Models via Adaptive Critique Refinement for Code Generation
por: Zhou, Changzhi, et al.
Publicado: (2025)
por: Zhou, Changzhi, et al.
Publicado: (2025)
Critique of Impure Reason: Unveiling the reasoning behaviour of medical Large Language Models
por: Sim, Shamus, et al.
Publicado: (2024)
por: Sim, Shamus, et al.
Publicado: (2024)
Boosting Self-Efficacy and Performance of Large Language Models via Verbal Efficacy Stimulations
por: Chen, Rui, et al.
Publicado: (2025)
por: Chen, Rui, et al.
Publicado: (2025)
Calibrating Verbalized Probabilities for Large Language Models
por: Wang, Cheng, et al.
Publicado: (2024)
por: Wang, Cheng, et al.
Publicado: (2024)
CritiqueLLM: Towards an Informative Critique Generation Model for Evaluation of Large Language Model Generation
por: Ke, Pei, et al.
Publicado: (2023)
por: Ke, Pei, et al.
Publicado: (2023)
Enhancing LLM Reasoning via Critique Models with Test-Time and Training-Time Supervision
por: Xi, Zhiheng, et al.
Publicado: (2024)
por: Xi, Zhiheng, et al.
Publicado: (2024)
The Critique of Critique
por: Sun, Shichao, et al.
Publicado: (2024)
por: Sun, Shichao, et al.
Publicado: (2024)
Critique-GRPO: Advancing LLM Reasoning with Natural Language and Numerical Feedback
por: Zhang, Xiaoying, et al.
Publicado: (2025)
por: Zhang, Xiaoying, et al.
Publicado: (2025)
Critique-RL: Training Language Models for Critiquing through Two-Stage Reinforcement Learning
por: Xi, Zhiheng, et al.
Publicado: (2025)
por: Xi, Zhiheng, et al.
Publicado: (2025)
Accelerating Large Language Model Reasoning via Speculative Search
por: Wang, Zhihai, et al.
Publicado: (2025)
por: Wang, Zhihai, et al.
Publicado: (2025)
Hypothesis Testing Prompting Improves Deductive Reasoning in Large Language Models
por: Li, Yitian, et al.
Publicado: (2024)
por: Li, Yitian, et al.
Publicado: (2024)
Correct Answers from Sound Reasoning: Verifiable Process Supervision for Language Models
por: Kim, Kyuyoung, et al.
Publicado: (2026)
por: Kim, Kyuyoung, et al.
Publicado: (2026)
DeepCritic: Deliberate Critique with Large Language Models
por: Yang, Wenkai, et al.
Publicado: (2025)
por: Yang, Wenkai, et al.
Publicado: (2025)
Verbalized Confidence Triggers Self-Verification: Emergent Behavior Without Explicit Reasoning Supervision
por: Jang, Chaeyun, et al.
Publicado: (2025)
por: Jang, Chaeyun, et al.
Publicado: (2025)
CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
por: Gou, Zhibin, et al.
Publicado: (2023)
por: Gou, Zhibin, et al.
Publicado: (2023)
Latent Chain-of-Thought as Planning: Decoupling Reasoning from Verbalization
por: Wang, Jiecong, et al.
Publicado: (2026)
por: Wang, Jiecong, et al.
Publicado: (2026)
Scoring, Reasoning, and Selecting the Best! Ensembling Large Language Models via a Peer-Review Process
por: Chen, Zhijun, et al.
Publicado: (2025)
por: Chen, Zhijun, et al.
Publicado: (2025)
Improving Retrieval Augmented Language Model with Self-Reasoning
por: Xia, Yuan, et al.
Publicado: (2024)
por: Xia, Yuan, et al.
Publicado: (2024)
Teaching Language Models to Critique via Reinforcement Learning
por: Xie, Zhihui, et al.
Publicado: (2025)
por: Xie, Zhihui, et al.
Publicado: (2025)
A Survey of Process Reward Models: From Outcome Signals to Process Supervisions for Large Language Models
por: Zheng, Congmin, et al.
Publicado: (2025)
por: Zheng, Congmin, et al.
Publicado: (2025)
ConfTuner: Training Large Language Models to Express Their Confidence Verbally
por: Li, Yibo, et al.
Publicado: (2025)
por: Li, Yibo, et al.
Publicado: (2025)
Are Retrials All You Need? Enhancing Large Language Model Reasoning Without Verbalized Feedback
por: Potamitis, Nearchos, et al.
Publicado: (2025)
por: Potamitis, Nearchos, et al.
Publicado: (2025)
Narrative-of-Thought: Improving Temporal Reasoning of Large Language Models via Recounted Narratives
por: Zhang, Xinliang Frederick, et al.
Publicado: (2024)
por: Zhang, Xinliang Frederick, et al.
Publicado: (2024)
The Lighthouse of Language: Enhancing LLM Agents via Critique-Guided Improvement
por: Yang, Ruihan, et al.
Publicado: (2025)
por: Yang, Ruihan, et al.
Publicado: (2025)
Self-Evolving Critique Abilities in Large Language Models
por: Tang, Zhengyang, et al.
Publicado: (2025)
por: Tang, Zhengyang, et al.
Publicado: (2025)
Attention-Aligned Reasoning for Large Language Models
por: Zhang, Hongxiang, et al.
Publicado: (2025)
por: Zhang, Hongxiang, et al.
Publicado: (2025)
Teaching Models to Verbalize Reward Hacking in Chain-of-Thought Reasoning
por: Turpin, Miles, et al.
Publicado: (2025)
por: Turpin, Miles, et al.
Publicado: (2025)
Mitigating Overthinking in Large Reasoning Language Models via Reasoning Path Deviation Monitoring
por: Guan, Weixin, et al.
Publicado: (2026)
por: Guan, Weixin, et al.
Publicado: (2026)
Meta-Reasoning Improves Tool Use in Large Language Models
por: Alazraki, Lisa, et al.
Publicado: (2024)
por: Alazraki, Lisa, et al.
Publicado: (2024)
Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning
por: Luo, Linhao, et al.
Publicado: (2023)
por: Luo, Linhao, et al.
Publicado: (2023)
Improved Supervised Fine-Tuning for Large Language Models to Mitigate Catastrophic Forgetting
por: Ding, Fei, et al.
Publicado: (2025)
por: Ding, Fei, et al.
Publicado: (2025)
Look Before You Leap: Problem Elaboration Prompting Improves Mathematical Reasoning in Large Language Models
por: Liao, Haoran, et al.
Publicado: (2024)
por: Liao, Haoran, et al.
Publicado: (2024)
Enigmata: Scaling Logical Reasoning in Large Language Models with Synthetic Verifiable Puzzles
por: Chen, Jiangjie, et al.
Publicado: (2025)
por: Chen, Jiangjie, et al.
Publicado: (2025)
BayesAgent: Bayesian Agentic Reasoning Under Uncertainty via Verbalized Probabilistic Graphical Modeling
por: Huang, Hengguan, et al.
Publicado: (2024)
por: Huang, Hengguan, et al.
Publicado: (2024)
Improving Reasoning Performance in Large Language Models via Representation Engineering
por: Højer, Bertram, et al.
Publicado: (2025)
por: Højer, Bertram, et al.
Publicado: (2025)
Incentivizing Dual Process Thinking for Efficient Large Language Model Reasoning
por: Cheng, Xiaoxue, et al.
Publicado: (2025)
por: Cheng, Xiaoxue, et al.
Publicado: (2025)
Large Language Models Can Self-Improve in Long-context Reasoning
por: Li, Siheng, et al.
Publicado: (2024)
por: Li, Siheng, et al.
Publicado: (2024)
Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models
por: Xu, Fengli, et al.
Publicado: (2025)
por: Xu, Fengli, et al.
Publicado: (2025)
Unveiling the Limits of Large Language Models in Inferring Pragmatic Meaning from Non-Verbal Responses
por: Eo, Sugyeong, et al.
Publicado: (2026)
por: Eo, Sugyeong, et al.
Publicado: (2026)
Ejemplares similares
-
Verbal Process Supervision Elicits Better Coding Agents
por: Chen, Hao-Yuan, et al.
Publicado: (2025) -
RefineCoder: Iterative Improving of Large Language Models via Adaptive Critique Refinement for Code Generation
por: Zhou, Changzhi, et al.
Publicado: (2025) -
Critique of Impure Reason: Unveiling the reasoning behaviour of medical Large Language Models
por: Sim, Shamus, et al.
Publicado: (2024) -
Boosting Self-Efficacy and Performance of Large Language Models via Verbal Efficacy Stimulations
por: Chen, Rui, et al.
Publicado: (2025) -
Calibrating Verbalized Probabilities for Large Language Models
por: Wang, Cheng, et al.
Publicado: (2024)