Can Prompt Difficulty be Online Predicted for Accelerating RL Finetuning of Reasoning Models?

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Qu, Yun, Wang, Qi, Mao, Yixiu, Hu, Vincent Tao, Ommer, Björn, Ji, Xiangyang
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!

Similar Items