Kancheti, S. S., Kanade, A., Sinha, R., Balasubramanian, V. N., & Ganu, T. (2026). Faithful GRPO: Improving Visual Spatial Reasoning in Multimodal Language Models via Constrained Policy Optimization.
Chicago-Zitierstil (17. Ausg.)Kancheti, Sai Srinivas, Aditya Kanade, Rohit Sinha, Vineeth N. Balasubramanian, und Tanuja Ganu. Faithful GRPO: Improving Visual Spatial Reasoning in Multimodal Language Models via Constrained Policy Optimization. 2026.
MLA-Zitierstil (9. Ausg.)Kancheti, Sai Srinivas, et al. Faithful GRPO: Improving Visual Spatial Reasoning in Multimodal Language Models via Constrained Policy Optimization. 2026.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.