Byun, J., Chun, J., Kil, J., & Perrault, A. (2024). ARES: Alternating Reinforcement Learning and Supervised Fine-Tuning for Enhanced Multi-Modal Chain-of-Thought Reasoning Through Diverse AI Feedback.
Chicago-Zitierstil (17. Ausg.)Byun, Ju-Seung, Jiyun Chun, Jihyung Kil, und Andrew Perrault. ARES: Alternating Reinforcement Learning and Supervised Fine-Tuning for Enhanced Multi-Modal Chain-of-Thought Reasoning Through Diverse AI Feedback. 2024.
MLA-Zitierstil (9. Ausg.)Byun, Ju-Seung, et al. ARES: Alternating Reinforcement Learning and Supervised Fine-Tuning for Enhanced Multi-Modal Chain-of-Thought Reasoning Through Diverse AI Feedback. 2024.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.