Gupta, R., Sullivan, R., Li, Y., Phatale, S., & Rastogi, A. (2025). Robust Multi-Objective Preference Alignment with Online DPO.
Cita Chicago Style (17a ed.)Gupta, Raghav, Ryan Sullivan, Yunxuan Li, Samrat Phatale, y Abhinav Rastogi. Robust Multi-Objective Preference Alignment with Online DPO. 2025.
Cita MLA (9a ed.)Gupta, Raghav, et al. Robust Multi-Objective Preference Alignment with Online DPO. 2025.
Precaución: Estas citas no son 100% exactas.