RLEP: Reinforcement Learning with Experience Replay for LLM Reasoning

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Zhang, Hongzhi, Fu, Jia, Zhang, Jingyuan, Fu, Kai, Wang, Qi, Zhang, Fuzheng, Zhou, Guorui
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!