Lee, K., Hwang, D., Park, S., Jang, Y., & Lee, M. (2024). Reinforcement Learning from Reflective Feedback (RLRF): Aligning and Improving LLMs via Fine-Grained Self-Reflection.
Chicago-Zitierstil (17. Ausg.)Lee, Kyungjae, Dasol Hwang, Sunghyun Park, Youngsoo Jang, und Moontae Lee. Reinforcement Learning from Reflective Feedback (RLRF): Aligning and Improving LLMs via Fine-Grained Self-Reflection. 2024.
MLA-Zitierstil (9. Ausg.)Lee, Kyungjae, et al. Reinforcement Learning from Reflective Feedback (RLRF): Aligning and Improving LLMs via Fine-Grained Self-Reflection. 2024.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.