Cita APA (7a ed.)

Wang, J., & Huang, J. (2026). Reward Hacking as Equilibrium under Finite Evaluation.

Cita Chicago Style (17a ed.)

Wang, Jiacheng, y Jinbin Huang. Reward Hacking as Equilibrium Under Finite Evaluation. 2026.

Cita MLA (9a ed.)

Wang, Jiacheng, y Jinbin Huang. Reward Hacking as Equilibrium Under Finite Evaluation. 2026.

Precaución: Estas citas no son 100% exactas.