OThink-SRR1: Search, Refine and Reasoning with Reinforced Learning for Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Liang, Haijian, Niu, Zenghao, Wu, Junjie, Zhang, Changwang, Zhou, Wangchunshu, Wang, Jun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
OThink-R1: Intrinsic Fast/Slow Thinking Mode Switching for Over-Reasoning Mitigation
von: Zhang, Shengjia, et al.
Veröffentlicht: (2025)
von: Zhang, Shengjia, et al.
Veröffentlicht: (2025)
AFSPP: Agent Framework for Shaping Preference and Personality with Large Language Models
von: He, Zihong, et al.
Veröffentlicht: (2024)
von: He, Zihong, et al.
Veröffentlicht: (2024)
Large Language Model Sourcing: A Survey
von: Pang, Liang, et al.
Veröffentlicht: (2025)
von: Pang, Liang, et al.
Veröffentlicht: (2025)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
von: Chen, Mingyang, et al.
Veröffentlicht: (2025)
von: Chen, Mingyang, et al.
Veröffentlicht: (2025)
Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement
von: Xi, Zhiheng, et al.
Veröffentlicht: (2023)
von: Xi, Zhiheng, et al.
Veröffentlicht: (2023)
SEM: Reinforcement Learning for Search-Efficient Large Language Models
von: Sha, Zeyang, et al.
Veröffentlicht: (2025)
von: Sha, Zeyang, et al.
Veröffentlicht: (2025)
ChemAgent: Self-updating Library in Large Language Models Improves Chemical Reasoning
von: Tang, Xiangru, et al.
Veröffentlicht: (2025)
von: Tang, Xiangru, et al.
Veröffentlicht: (2025)
Embedding Domain Knowledge for Large Language Models via Reinforcement Learning from Augmented Generation
von: Nie, Chaojun, et al.
Veröffentlicht: (2025)
von: Nie, Chaojun, et al.
Veröffentlicht: (2025)
Search and Refine During Think: Facilitating Knowledge Refinement for Improved Retrieval-Augmented Reasoning
von: Shi, Yaorui, et al.
Veröffentlicht: (2025)
von: Shi, Yaorui, et al.
Veröffentlicht: (2025)
Concise and Organized Perception Facilitates Reasoning in Large Language Models
von: Liu, Junjie, et al.
Veröffentlicht: (2023)
von: Liu, Junjie, et al.
Veröffentlicht: (2023)
Accelerating Large Language Model Reasoning via Speculative Search
von: Wang, Zhihai, et al.
Veröffentlicht: (2025)
von: Wang, Zhihai, et al.
Veröffentlicht: (2025)
SSR: Socratic Self-Refine for Large Language Model Reasoning
von: Shi, Haizhou, et al.
Veröffentlicht: (2025)
von: Shi, Haizhou, et al.
Veröffentlicht: (2025)
Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models
von: Xu, Fengli, et al.
Veröffentlicht: (2025)
von: Xu, Fengli, et al.
Veröffentlicht: (2025)
Efficient Post-Training Refinement of Latent Reasoning in Large Language Models
von: Wang, Xinyuan, et al.
Veröffentlicht: (2025)
von: Wang, Xinyuan, et al.
Veröffentlicht: (2025)
Large Language Models are Contrastive Reasoners
von: Yao, Liang
Veröffentlicht: (2024)
von: Yao, Liang
Veröffentlicht: (2024)
Search-o1: Agentic Search-Enhanced Large Reasoning Models
von: Li, Xiaoxi, et al.
Veröffentlicht: (2025)
von: Li, Xiaoxi, et al.
Veröffentlicht: (2025)
Cooper: Co-Optimizing Policy and Reward Models in Reinforcement Learning for Large Language Models
von: Hong, Haitao, et al.
Veröffentlicht: (2025)
von: Hong, Haitao, et al.
Veröffentlicht: (2025)
Image-of-Thought Prompting for Visual Reasoning Refinement in Multimodal Large Language Models
von: Zhou, Qiji, et al.
Veröffentlicht: (2024)
von: Zhou, Qiji, et al.
Veröffentlicht: (2024)
JudgeRank: Leveraging Large Language Models for Reasoning-Intensive Reranking
von: Niu, Tong, et al.
Veröffentlicht: (2024)
von: Niu, Tong, et al.
Veröffentlicht: (2024)
Auto-Search and Refinement: An Automated Framework for Gender Bias Mitigation in Large Language Models
von: Xu, Yue, et al.
Veröffentlicht: (2025)
von: Xu, Yue, et al.
Veröffentlicht: (2025)
Route-and-Reason: Scaling Large Language Model Reasoning with Reinforced Model Router
von: Shao, Chenyang, et al.
Veröffentlicht: (2025)
von: Shao, Chenyang, et al.
Veröffentlicht: (2025)
SRR-Judge: Step-Level Rating and Refinement for Enhancing Search-Integrated Reasoning in Search Agents
von: Zhang, Chen, et al.
Veröffentlicht: (2026)
von: Zhang, Chen, et al.
Veröffentlicht: (2026)
Towards Faithful and Controllable Personalization via Critique-Post-Edit Reinforcement Learning
von: Zhu, Chenghao, et al.
Veröffentlicht: (2025)
von: Zhu, Chenghao, et al.
Veröffentlicht: (2025)
iCLP: Large Language Model Reasoning with Implicit Cognition Latent Planning
von: Chen, Sijia, et al.
Veröffentlicht: (2025)
von: Chen, Sijia, et al.
Veröffentlicht: (2025)
Med-U1: Incentivizing Unified Medical Reasoning in LLMs via Large-scale Reinforcement Learning
von: Zhang, Xiaotian, et al.
Veröffentlicht: (2025)
von: Zhang, Xiaotian, et al.
Veröffentlicht: (2025)
Large Language Models Are Neurosymbolic Reasoners
von: Fang, Meng, et al.
Veröffentlicht: (2024)
von: Fang, Meng, et al.
Veröffentlicht: (2024)
Search-R2: Enhancing Search-Integrated Reasoning via Actor-Refiner Collaboration
von: He, Bowei, et al.
Veröffentlicht: (2026)
von: He, Bowei, et al.
Veröffentlicht: (2026)
Training Large Language Models for Reasoning through Reverse Curriculum Reinforcement Learning
von: Xi, Zhiheng, et al.
Veröffentlicht: (2024)
von: Xi, Zhiheng, et al.
Veröffentlicht: (2024)
RefineCoder: Iterative Improving of Large Language Models via Adaptive Critique Refinement for Code Generation
von: Zhou, Changzhi, et al.
Veröffentlicht: (2025)
von: Zhou, Changzhi, et al.
Veröffentlicht: (2025)
A Simple "Motivation" Can Enhance Reinforcement Finetuning of Large Reasoning Models
von: Zhang, Junjie, et al.
Veröffentlicht: (2025)
von: Zhang, Junjie, et al.
Veröffentlicht: (2025)
A Survey of Inductive Reasoning for Large Language Models
von: Chen, Kedi, et al.
Veröffentlicht: (2025)
von: Chen, Kedi, et al.
Veröffentlicht: (2025)
Don't Take Things Out of Context: Attention Intervention for Enhancing Chain-of-Thought Reasoning in Large Language Models
von: Yan, Shaotian, et al.
Veröffentlicht: (2025)
von: Yan, Shaotian, et al.
Veröffentlicht: (2025)
ProRL: Prolonged Reinforcement Learning Expands Reasoning Boundaries in Large Language Models
von: Liu, Mingjie, et al.
Veröffentlicht: (2025)
von: Liu, Mingjie, et al.
Veröffentlicht: (2025)
Who Reasons in the Large Language Models?
von: Shao, Jie, et al.
Veröffentlicht: (2025)
von: Shao, Jie, et al.
Veröffentlicht: (2025)
Coupled Variational Reinforcement Learning for Language Model General Reasoning
von: Wen, Xueru, et al.
Veröffentlicht: (2025)
von: Wen, Xueru, et al.
Veröffentlicht: (2025)
Adaptive Ability Decomposing for Unlocking Large Reasoning Model Effective Reinforcement Learning
von: Chen, Zhipeng, et al.
Veröffentlicht: (2026)
von: Chen, Zhipeng, et al.
Veröffentlicht: (2026)
ML-Bench: Evaluating Large Language Models and Agents for Machine Learning Tasks on Repository-Level Code
von: Tang, Xiangru, et al.
Veröffentlicht: (2023)
von: Tang, Xiangru, et al.
Veröffentlicht: (2023)
Reasoning Models Hallucinate More: Factuality-Aware Reinforcement Learning for Large Reasoning Models
von: Li, Junyi, et al.
Veröffentlicht: (2025)
von: Li, Junyi, et al.
Veröffentlicht: (2025)
Exploring the Compositional Deficiency of Large Language Models in Mathematical Reasoning
von: Zhao, Jun, et al.
Veröffentlicht: (2024)
von: Zhao, Jun, et al.
Veröffentlicht: (2024)
From Prediction to Justification: Aligning Sentiment Reasoning with Human Rationale via Reinforcement Learning
von: Zhang, Shihao, et al.
Veröffentlicht: (2026)
von: Zhang, Shihao, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
OThink-R1: Intrinsic Fast/Slow Thinking Mode Switching for Over-Reasoning Mitigation
von: Zhang, Shengjia, et al.
Veröffentlicht: (2025) -
AFSPP: Agent Framework for Shaping Preference and Personality with Large Language Models
von: He, Zihong, et al.
Veröffentlicht: (2024) -
Large Language Model Sourcing: A Survey
von: Pang, Liang, et al.
Veröffentlicht: (2025) -
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
von: Chen, Mingyang, et al.
Veröffentlicht: (2025) -
Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement
von: Xi, Zhiheng, et al.
Veröffentlicht: (2023)