Enhancing Efficiency and Exploration in Reinforcement Learning for LLMs

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Liao, Mengqi, Xi, Xiangyu, Chen, Ruinian, Leng, Jia, Hu, Yangen, Zeng, Ke, Liu, Shuai, Wan, Huaiyu
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!