Ahmed, A. M., Rafailov, R., Sharkov, S., Li, X., & Koyejo, S. (2024). Scalable Ensembling For Mitigating Reward Overoptimisation.
Style de citation Chicago (17e éd.)Ahmed, Ahmed M., Rafael Rafailov, Stepan Sharkov, Xuechen Li, et Sanmi Koyejo. Scalable Ensembling For Mitigating Reward Overoptimisation. 2024.
Style de citation MLA (9e éd.)Ahmed, Ahmed M., et al. Scalable Ensembling For Mitigating Reward Overoptimisation. 2024.
Attention : ces citations peuvent ne pas être correctes à 100%.