Peng, K., Tan, C., Liu, Y., Tang, G., Sun, Z., Yang, W., . . . Peng, H. (2026). Dialogue Model Optimization via Agent Game and Adaptive Tree-based GRPO.
Chicago-Zitierstil (17. Ausg.)Peng, Kun, et al. Dialogue Model Optimization via Agent Game and Adaptive Tree-based GRPO. 2026.
MLA-Zitierstil (9. Ausg.)Peng, Kun, et al. Dialogue Model Optimization via Agent Game and Adaptive Tree-based GRPO. 2026.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.