NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Liu, Wei, Qi, Siya, Wang, Xinyu, Qian, Chen, Du, Yali, He, Yulan
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!