Lin, B., Jiang, W., Xu, Y., Chen, H., & Chen, Y. (2025). PARM: Multi-Objective Test-Time Alignment via Preference-Aware Autoregressive Reward Model.
Chicago Style (17th ed.) CitationLin, Baijiong, Weisen Jiang, Yuancheng Xu, Hao Chen, and Ying-Cong Chen. PARM: Multi-Objective Test-Time Alignment via Preference-Aware Autoregressive Reward Model. 2025.
MLA (9th ed.) CitationLin, Baijiong, et al. PARM: Multi-Objective Test-Time Alignment via Preference-Aware Autoregressive Reward Model. 2025.
Warning: These citations may not always be 100% accurate.