From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Tan, Yuqiao, Wang, Minzheng, Liu, Bo, Liu, Zichen, Liang, Tian, He, Shizhu, Zhao, Jun, Liu, Kang
Format: Preprint
Veröffentlicht: 2026
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!

Ähnliche Einträge