Pan, P., Liang, Y., & Lin, S. (2026). Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation.
Chicago-Zitierstil (17. Ausg.)Pan, Pei-Chi, Yingbin Liang, und Sen Lin. Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation. 2026.
MLA-Zitierstil (9. Ausg.)Pan, Pei-Chi, et al. Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation. 2026.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.