From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Tan, Yuqiao, Wang, Minzheng, Liu, Bo, Liu, Zichen, Liang, Tian, He, Shizhu, Zhao, Jun, Liu, Kang
Format: Preprint
Published: 2026
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!