Lou, X., Zhang, J., Xie, J., Liu, L., Yan, D., & Huang, K. (2024). SPO: Multi-Dimensional Preference Sequential Alignment With Implicit Reward Modeling.
Chicago Style (17th ed.) CitationLou, Xingzhou, Junge Zhang, Jian Xie, Lifeng Liu, Dong Yan, and Kaiqi Huang. SPO: Multi-Dimensional Preference Sequential Alignment With Implicit Reward Modeling. 2024.
MLA (9th ed.) CitationLou, Xingzhou, et al. SPO: Multi-Dimensional Preference Sequential Alignment With Implicit Reward Modeling. 2024.
Warning: These citations may not always be 100% accurate.