The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Cui, Ganqu, Zhang, Yuchen, Chen, Jiacheng, Yuan, Lifan, Wang, Zhi, Zuo, Yuxin, Li, Haozhan, Fan, Yuchen, Chen, Huayu, Chen, Weize, Liu, Zhiyuan, Peng, Hao, Bai, Lei, Ouyang, Wanli, Cheng, Yu, Zhou, Bowen, Ding, Ning
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!