Deng, F., Wang, Q., Wei, W., Grundmann, M., & Hou, T. (2024). PRDP: Proximal Reward Difference Prediction for Large-Scale Reward Finetuning of Diffusion Models.
Cita Chicago Style (17a ed.)Deng, Fei, Qifei Wang, Wei Wei, Matthias Grundmann, y Tingbo Hou. PRDP: Proximal Reward Difference Prediction for Large-Scale Reward Finetuning of Diffusion Models. 2024.
Cita MLA (9a ed.)Deng, Fei, et al. PRDP: Proximal Reward Difference Prediction for Large-Scale Reward Finetuning of Diffusion Models. 2024.
Precaución: Estas citas no son 100% exactas.