Lee, K., Hwang, D., Park, S., Jang, Y., & Lee, M. (2024). Reinforcement Learning from Reflective Feedback (RLRF): Aligning and Improving LLMs via Fine-Grained Self-Reflection.
Chicago Style (17th ed.) CitationLee, Kyungjae, Dasol Hwang, Sunghyun Park, Youngsoo Jang, and Moontae Lee. Reinforcement Learning from Reflective Feedback (RLRF): Aligning and Improving LLMs via Fine-Grained Self-Reflection. 2024.
MLA (9th ed.) CitationLee, Kyungjae, et al. Reinforcement Learning from Reflective Feedback (RLRF): Aligning and Improving LLMs via Fine-Grained Self-Reflection. 2024.
Warning: These citations may not always be 100% accurate.