Steering Large Reasoning Models towards Concise Reasoning via Flow Matching
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Yawei, Bergner, Benjamin, Zhao, Yinghan, Patil, Vihang Prakash, Chen, Bei, Wang, Cheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Self-Training Elicits Concise Reasoning in Large Language Models
di: Munkhbat, Tergel, et al.
Pubblicazione: (2025)
di: Munkhbat, Tergel, et al.
Pubblicazione: (2025)
Mitigating Overthinking in Large Reasoning Models via Manifold Steering
di: Huang, Yao, et al.
Pubblicazione: (2025)
di: Huang, Yao, et al.
Pubblicazione: (2025)
HAPO: Training Language Models to Reason Concisely via History-Aware Policy Optimization
di: Huang, Chengyu, et al.
Pubblicazione: (2025)
di: Huang, Chengyu, et al.
Pubblicazione: (2025)
FlowRL: Matching Reward Distributions for LLM Reasoning
di: Zhu, Xuekai, et al.
Pubblicazione: (2025)
di: Zhu, Xuekai, et al.
Pubblicazione: (2025)
From Noisy Traces to Stable Gradients: Bias-Variance Optimized Preference Optimization for Aligning Large Reasoning Models
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
Understanding and Steering the Cognitive Behaviors of Reasoning Models at Test-Time
di: Zhang, Zhenyu, et al.
Pubblicazione: (2025)
di: Zhang, Zhenyu, et al.
Pubblicazione: (2025)
ConciseRL: Conciseness-Guided Reinforcement Learning for Efficient Reasoning Models
di: Dumitru, Razvan-Gabriel, et al.
Pubblicazione: (2025)
di: Dumitru, Razvan-Gabriel, et al.
Pubblicazione: (2025)
Efficient Reasoning for Large Reasoning Language Models via Certainty-Guided Reflection Suppression
di: Huang, Jiameng, et al.
Pubblicazione: (2025)
di: Huang, Jiameng, et al.
Pubblicazione: (2025)
Rethinking Entropy Regularization in Large Reasoning Models
di: Jiang, Yuxian, et al.
Pubblicazione: (2025)
di: Jiang, Yuxian, et al.
Pubblicazione: (2025)
Dynamic Thinking-Token Selection for Efficient Reasoning in Large Reasoning Models
di: Guo, Zhenyuan, et al.
Pubblicazione: (2026)
di: Guo, Zhenyuan, et al.
Pubblicazione: (2026)
Mitigating Hallucinations in Large Language Models via Causal Reasoning
di: Li, Yuangang, et al.
Pubblicazione: (2025)
di: Li, Yuangang, et al.
Pubblicazione: (2025)
Directional Attractors in LLM Reasoning: How Similarity Retrieval Steers Iterative Summarization Based Reasoning
di: Tekin, Cagatay, et al.
Pubblicazione: (2025)
di: Tekin, Cagatay, et al.
Pubblicazione: (2025)
Take a Step Back: Evoking Reasoning via Abstraction in Large Language Models
di: Zheng, Huaixiu Steven, et al.
Pubblicazione: (2023)
di: Zheng, Huaixiu Steven, et al.
Pubblicazione: (2023)
Large Language and Reasoning Models are Shallow Disjunctive Reasoners
di: Khalid, Irtaza, et al.
Pubblicazione: (2025)
di: Khalid, Irtaza, et al.
Pubblicazione: (2025)
From Large to Small: Transferring CUDA Optimization Expertise via Reasoning Graph
di: Gong, Junfeng, et al.
Pubblicazione: (2025)
di: Gong, Junfeng, et al.
Pubblicazione: (2025)
Fractional Reasoning via Latent Steering Vectors Improves Inference Time Compute
di: Liu, Sheng, et al.
Pubblicazione: (2025)
di: Liu, Sheng, et al.
Pubblicazione: (2025)
SpecExit: Accelerating Large Reasoning Model via Speculative Exit
di: Yang, Rubing, et al.
Pubblicazione: (2025)
di: Yang, Rubing, et al.
Pubblicazione: (2025)
Enhancing Domain-Specific Retrieval-Augmented Generation: Synthetic Data Generation and Evaluation using Reasoning Models
di: Jadon, Aryan, et al.
Pubblicazione: (2025)
di: Jadon, Aryan, et al.
Pubblicazione: (2025)
Compositional Steering of Large Language Models with Steering Tokens
di: Radevski, Gorjan, et al.
Pubblicazione: (2026)
di: Radevski, Gorjan, et al.
Pubblicazione: (2026)
Early Stopping for Large Reasoning Models via Confidence Dynamics
di: Hosseini, Parsa, et al.
Pubblicazione: (2026)
di: Hosseini, Parsa, et al.
Pubblicazione: (2026)
Competitive Programming with Large Reasoning Models
di: OpenAI, et al.
Pubblicazione: (2025)
di: OpenAI, et al.
Pubblicazione: (2025)
COLD-Steer: Steering Large Language Models via In-Context One-step Learning Dynamics
di: Sharma, Kartik, et al.
Pubblicazione: (2026)
di: Sharma, Kartik, et al.
Pubblicazione: (2026)
WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct
di: Luo, Haipeng, et al.
Pubblicazione: (2023)
di: Luo, Haipeng, et al.
Pubblicazione: (2023)
The Role of Deductive and Inductive Reasoning in Large Language Models
di: Cai, Chengkun, et al.
Pubblicazione: (2024)
di: Cai, Chengkun, et al.
Pubblicazione: (2024)
Where Do Reasoning Models Refuse?
di: Yamaguchi, Kureha, et al.
Pubblicazione: (2025)
di: Yamaguchi, Kureha, et al.
Pubblicazione: (2025)
Large Language Model Reasoning Failures
di: Song, Peiyang, et al.
Pubblicazione: (2026)
di: Song, Peiyang, et al.
Pubblicazione: (2026)
Toward Adaptive Reasoning in Large Language Models with Thought Rollback
di: Chen, Sijia, et al.
Pubblicazione: (2024)
di: Chen, Sijia, et al.
Pubblicazione: (2024)
DTS: Enhancing Large Reasoning Models via Decoding Tree Sketching
di: Xu, Zicheng, et al.
Pubblicazione: (2025)
di: Xu, Zicheng, et al.
Pubblicazione: (2025)
Improving Reasoning Performance in Large Language Models via Representation Engineering
di: Højer, Bertram, et al.
Pubblicazione: (2025)
di: Højer, Bertram, et al.
Pubblicazione: (2025)
Stepwise Self-Consistent Mathematical Reasoning with Large Language Models
di: Zhao, Zilong, et al.
Pubblicazione: (2024)
di: Zhao, Zilong, et al.
Pubblicazione: (2024)
An Enigma of Artificial Reason: Investigating the Production-Evaluation Gap in Large Reasoning Models
di: Sun, Mingzhong, et al.
Pubblicazione: (2026)
di: Sun, Mingzhong, et al.
Pubblicazione: (2026)
Pass@k Training for Adaptively Balancing Exploration and Exploitation of Large Reasoning Models
di: Chen, Zhipeng, et al.
Pubblicazione: (2025)
di: Chen, Zhipeng, et al.
Pubblicazione: (2025)
Skywork-Math: Data Scaling Laws for Mathematical Reasoning in Large Language Models -- The Story Goes On
di: Zeng, Liang, et al.
Pubblicazione: (2024)
di: Zeng, Liang, et al.
Pubblicazione: (2024)
Towards More Accurate US Presidential Election via Multi-step Reasoning with Large Language Models
di: Yu, Chenxiao, et al.
Pubblicazione: (2024)
di: Yu, Chenxiao, et al.
Pubblicazione: (2024)
Anti-Self-Distillation for Reasoning RL via Pointwise Mutual Information
di: Shen, Guobin, et al.
Pubblicazione: (2026)
di: Shen, Guobin, et al.
Pubblicazione: (2026)
Reinforcement Learning for Reasoning in Large Language Models with One Training Example
di: Wang, Yiping, et al.
Pubblicazione: (2025)
di: Wang, Yiping, et al.
Pubblicazione: (2025)
$T^2$ of Thoughts: Temperature Tree Elicits Reasoning in Large Language Models
di: Cai, Chengkun, et al.
Pubblicazione: (2024)
di: Cai, Chengkun, et al.
Pubblicazione: (2024)
Can Large Language Models Reason and Plan?
di: Kambhampati, Subbarao
Pubblicazione: (2024)
di: Kambhampati, Subbarao
Pubblicazione: (2024)
AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models
di: Yeh, Cheng-Kai, et al.
Pubblicazione: (2025)
di: Yeh, Cheng-Kai, et al.
Pubblicazione: (2025)
A Survey of Reinforcement Learning for Large Reasoning Models
di: Zhang, Kaiyan, et al.
Pubblicazione: (2025)
di: Zhang, Kaiyan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Self-Training Elicits Concise Reasoning in Large Language Models
di: Munkhbat, Tergel, et al.
Pubblicazione: (2025) -
Mitigating Overthinking in Large Reasoning Models via Manifold Steering
di: Huang, Yao, et al.
Pubblicazione: (2025) -
HAPO: Training Language Models to Reason Concisely via History-Aware Policy Optimization
di: Huang, Chengyu, et al.
Pubblicazione: (2025) -
FlowRL: Matching Reward Distributions for LLM Reasoning
di: Zhu, Xuekai, et al.
Pubblicazione: (2025) -
From Noisy Traces to Stable Gradients: Bias-Variance Optimized Preference Optimization for Aligning Large Reasoning Models
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)