Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Xu, Fengli, Hao, Qianyue, Zong, Zefang, Wang, Jingwei, Zhang, Yunke, Wang, Jingyi, Lan, Xiaochong, Gong, Jiahui, Ouyang, Tianjian, Meng, Fanjin, Shao, Chenyang, Yan, Yuwei, Yang, Qinglong, Song, Yiwen, Ren, Sijian, Hu, Xinyuan, Li, Yu, Feng, Jie, Gao, Chen, Li, Yong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Diffuse Thinking: Exploring Diffusion Language Models as Efficient Thought Proposers for Reasoning
von: Shao, Chenyang, et al.
Veröffentlicht: (2025)
von: Shao, Chenyang, et al.
Veröffentlicht: (2025)
Route-and-Reason: Scaling Large Language Model Reasoning with Reinforced Model Router
von: Shao, Chenyang, et al.
Veröffentlicht: (2025)
von: Shao, Chenyang, et al.
Veröffentlicht: (2025)
Enhancing Local Life Service Recommendation with Agentic Reasoning in Large Language Model
von: Cao, Shiteng, et al.
Veröffentlicht: (2026)
von: Cao, Shiteng, et al.
Veröffentlicht: (2026)
Division-of-Thoughts: Harnessing Hybrid Language Model Synergy for Efficient On-Device Agents
von: Shao, Chenyang, et al.
Veröffentlicht: (2025)
von: Shao, Chenyang, et al.
Veröffentlicht: (2025)
AgentStealth: Reinforcing Large Language Model for Anonymizing User-generated Text
von: Shao, Chenyang, et al.
Veröffentlicht: (2025)
von: Shao, Chenyang, et al.
Veröffentlicht: (2025)
The Thinking Spectrum: An Empirical Study of Tunable Reasoning in LLMs through Model Merging
von: Lan, Xiaochong, et al.
Veröffentlicht: (2025)
von: Lan, Xiaochong, et al.
Veröffentlicht: (2025)
Simulating Generative Social Agents via Theory-Informed Workflow Design
von: Yan, Yuwei, et al.
Veröffentlicht: (2025)
von: Yan, Yuwei, et al.
Veröffentlicht: (2025)
EconLogicQA: A Question-Answering Benchmark for Evaluating Large Language Models in Economic Sequential Reasoning
von: Quan, Yinzhu, et al.
Veröffentlicht: (2024)
von: Quan, Yinzhu, et al.
Veröffentlicht: (2024)
Teaching Large Reasoning Models Effective Reflection
von: Wang, Hanbin, et al.
Veröffentlicht: (2026)
von: Wang, Hanbin, et al.
Veröffentlicht: (2026)
Precedent-Informed Reasoning: Mitigating Overthinking in Large Reasoning Models via Test-Time Precedent Learning
von: Wang, Qianyue, et al.
Veröffentlicht: (2026)
von: Wang, Qianyue, et al.
Veröffentlicht: (2026)
LLM-Explorer: A Plug-in Reinforcement Learning Policy Exploration Enhancement Driven by Large Language Models
von: Hao, Qianyue, et al.
Veröffentlicht: (2025)
von: Hao, Qianyue, et al.
Veröffentlicht: (2025)
BehaveGPT: A Foundation Model for Large-scale User Behavior Modeling
von: Gong, Jiahui, et al.
Veröffentlicht: (2025)
von: Gong, Jiahui, et al.
Veröffentlicht: (2025)
Reasoning-as-Logic-Units: Scaling Test-Time Reasoning in Large Language Models Through Logic Unit Alignment
von: Li, Cheryl, et al.
Veröffentlicht: (2025)
von: Li, Cheryl, et al.
Veröffentlicht: (2025)
KeyWorld: Key Frame Reasoning Enables Effective and Efficient World Models
von: Li, Sibo, et al.
Veröffentlicht: (2025)
von: Li, Sibo, et al.
Veröffentlicht: (2025)
Multiple Weaks Win Single Strong: Large Language Models Ensemble Weak Reinforcement Learning Agents into a Supreme One
von: Song, Yiwen, et al.
Veröffentlicht: (2025)
von: Song, Yiwen, et al.
Veröffentlicht: (2025)
Multi-Agent Collaboration in Incident Response with Large Language Models
von: Liu, Zefang
Veröffentlicht: (2024)
von: Liu, Zefang
Veröffentlicht: (2024)
LocalGPT: Benchmarking and Advancing Large Language Models for Local Life Services in Meituan
von: Lan, Xiaochong, et al.
Veröffentlicht: (2025)
von: Lan, Xiaochong, et al.
Veröffentlicht: (2025)
HLM-Cite: Hybrid Language Model Workflow for Text-based Scientific Citation Prediction
von: Hao, Qianyue, et al.
Veröffentlicht: (2024)
von: Hao, Qianyue, et al.
Veröffentlicht: (2024)
CityBench: Evaluating the Capabilities of Large Language Models for Urban Tasks
von: Feng, Jie, et al.
Veröffentlicht: (2024)
von: Feng, Jie, et al.
Veröffentlicht: (2024)
SciNet: Evaluating AI Agents in Relation-Aware Scientific Literature Retrieval
von: Shao, Chenyang, et al.
Veröffentlicht: (2025)
von: Shao, Chenyang, et al.
Veröffentlicht: (2025)
Conditional Advantage Estimation for Reinforcement Learning in Large Reasoning Models
von: Chen, Guanxu, et al.
Veröffentlicht: (2025)
von: Chen, Guanxu, et al.
Veröffentlicht: (2025)
Depression Detection on Social Media with Large Language Models
von: Lan, Xiaochong, et al.
Veröffentlicht: (2024)
von: Lan, Xiaochong, et al.
Veröffentlicht: (2024)
LLM Reasoners: New Evaluation, Library, and Analysis of Step-by-Step Reasoning with Large Language Models
von: Hao, Shibo, et al.
Veröffentlicht: (2024)
von: Hao, Shibo, et al.
Veröffentlicht: (2024)
Reinforcement Learning Fine-Tuning Enhances Activation Intensity and Diversity in the Internal Circuitry of LLMs
von: Zhang, Honglin, et al.
Veröffentlicht: (2025)
von: Zhang, Honglin, et al.
Veröffentlicht: (2025)
Artificial Intelligence Tools Expand Scientists' Impact but Contract Science's Focus (Just accepted by Nature, to be online soon)
von: Hao, Qianyue, et al.
Veröffentlicht: (2024)
von: Hao, Qianyue, et al.
Veröffentlicht: (2024)
Synergy-of-Thoughts: Eliciting Efficient Reasoning in Hybrid Language Models
von: Shang, Yu, et al.
Veröffentlicht: (2024)
von: Shang, Yu, et al.
Veröffentlicht: (2024)
LIMP: Large Language Model Enhanced Intent-aware Mobility Prediction
von: Li, Songwei, et al.
Veröffentlicht: (2024)
von: Li, Songwei, et al.
Veröffentlicht: (2024)
FEVO: Financial Knowledge Expansion and Reasoning Evolution for Large Language Models
von: Pang, Bo, et al.
Veröffentlicht: (2025)
von: Pang, Bo, et al.
Veröffentlicht: (2025)
Who Reasons in the Large Language Models?
von: Shao, Jie, et al.
Veröffentlicht: (2025)
von: Shao, Jie, et al.
Veröffentlicht: (2025)
A Survey on Large Language Models for Mathematical Reasoning
von: Wang, Peng-Yuan, et al.
Veröffentlicht: (2025)
von: Wang, Peng-Yuan, et al.
Veröffentlicht: (2025)
Reasoning or Retrieval? A Study of Answer Attribution on Large Reasoning Models
von: Wang, Yuhui, et al.
Veröffentlicht: (2025)
von: Wang, Yuhui, et al.
Veröffentlicht: (2025)
Reason-to-Recommend: Using Interaction-of-Thought Reasoning to Enhance LLM Recommendation
von: Zhao, Keyu, et al.
Veröffentlicht: (2025)
von: Zhao, Keyu, et al.
Veröffentlicht: (2025)
ReasoningShield: Safety Detection over Reasoning Traces of Large Reasoning Models
von: Li, Changyi, et al.
Veröffentlicht: (2025)
von: Li, Changyi, et al.
Veröffentlicht: (2025)
Rethinking and Benchmarking Large Language Models for Graph Reasoning
von: Hu, Yuwei, et al.
Veröffentlicht: (2025)
von: Hu, Yuwei, et al.
Veröffentlicht: (2025)
Retrieval-augmented Multi-modal Chain-of-Thoughts Reasoning for Large Language Models
von: Liu, Bingshuai, et al.
Veröffentlicht: (2023)
von: Liu, Bingshuai, et al.
Veröffentlicht: (2023)
Rethinking Entropy Regularization in Large Reasoning Models
von: Jiang, Yuxian, et al.
Veröffentlicht: (2025)
von: Jiang, Yuxian, et al.
Veröffentlicht: (2025)
ReHear: Iterative Pseudo-Label Refinement for Semi-Supervised Speech Recognition via Audio Large Language Models
von: Liu, Zefang, et al.
Veröffentlicht: (2026)
von: Liu, Zefang, et al.
Veröffentlicht: (2026)
Rethinking Reasoning Quality in Large Language Models through Enhanced Chain-of-Thought via RL
von: He, Haoyang, et al.
Veröffentlicht: (2025)
von: He, Haoyang, et al.
Veröffentlicht: (2025)
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
von: Wang, Jingyuan, et al.
Veröffentlicht: (2025)
von: Wang, Jingyuan, et al.
Veröffentlicht: (2025)
New Trends for Modern Machine Translation with Large Reasoning Models
von: Liu, Sinuo, et al.
Veröffentlicht: (2025)
von: Liu, Sinuo, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Diffuse Thinking: Exploring Diffusion Language Models as Efficient Thought Proposers for Reasoning
von: Shao, Chenyang, et al.
Veröffentlicht: (2025) -
Route-and-Reason: Scaling Large Language Model Reasoning with Reinforced Model Router
von: Shao, Chenyang, et al.
Veröffentlicht: (2025) -
Enhancing Local Life Service Recommendation with Agentic Reasoning in Large Language Model
von: Cao, Shiteng, et al.
Veröffentlicht: (2026) -
Division-of-Thoughts: Harnessing Hybrid Language Model Synergy for Efficient On-Device Agents
von: Shao, Chenyang, et al.
Veröffentlicht: (2025) -
AgentStealth: Reinforcing Large Language Model for Anonymizing User-generated Text
von: Shao, Chenyang, et al.
Veröffentlicht: (2025)