Li, K., & Guo, H. (2024). Human-in-the-Loop Policy Optimization for Preference-Based Multi-Objective Reinforcement Learning.
Chicago Style (17th ed.) CitationLi, Ke, and Han Guo. Human-in-the-Loop Policy Optimization for Preference-Based Multi-Objective Reinforcement Learning. 2024.
MLA (9th ed.) CitationLi, Ke, and Han Guo. Human-in-the-Loop Policy Optimization for Preference-Based Multi-Objective Reinforcement Learning. 2024.
Warning: These citations may not always be 100% accurate.