Enhancing Efficiency and Exploration in Reinforcement Learning for LLMs

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Liao, Mengqi, Xi, Xiangyu, Chen, Ruinian, Leng, Jia, Hu, Yangen, Zeng, Ke, Liu, Shuai, Wan, Huaiyu
Format: Preprint
Veröffentlicht: 2025
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!