OThink-SRR1: Search, Refine and Reasoning with Reinforced Learning for Large Language Models

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Liang, Haijian, Niu, Zenghao, Wu, Junjie, Zhang, Changwang, Zhou, Wangchunshu, Wang, Jun
Format: Preprint
Veröffentlicht: 2026
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!

Ähnliche Einträge