Wang, J., & Huang, J. (2026). Reward Hacking as Equilibrium under Finite Evaluation.
Cita Chicago Style (17a ed.)Wang, Jiacheng, y Jinbin Huang. Reward Hacking as Equilibrium Under Finite Evaluation. 2026.
Cita MLA (9a ed.)Wang, Jiacheng, y Jinbin Huang. Reward Hacking as Equilibrium Under Finite Evaluation. 2026.
Precaución: Estas citas no son 100% exactas.