Not All Thoughts are Generated Equal: Efficient LLM Reasoning via Multi-Turn Reinforcement Learning

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Ning, Yansong, Li, Wei, Fang, Jun, Tan, Naiqiang, Liu, Hao
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!