Ji, X., Kulkarni, S., Wang, M., & Xie, T. (2024). Self-Play with Adversarial Critic: Provable and Scalable Offline Alignment for Language Models.
Chicago-Zitierstil (17. Ausg.)Ji, Xiang, Sanjeev Kulkarni, Mengdi Wang, und Tengyang Xie. Self-Play with Adversarial Critic: Provable and Scalable Offline Alignment for Language Models. 2024.
MLA-Zitierstil (9. Ausg.)Ji, Xiang, et al. Self-Play with Adversarial Critic: Provable and Scalable Offline Alignment for Language Models. 2024.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.