Yan, Y., Tang, K., Chen, S., Xu, K., Hu, D., Yu, Q., & Hu, P. (2026). S-GRPO: Unified Post-Training for Large Vision-Language Models.
Chicago Style (17th ed.) CitationYan, Yuming, Kai Tang, Sihong Chen, Ke Xu, Dan Hu, Qun Yu, and Pengfei Hu. S-GRPO: Unified Post-Training for Large Vision-Language Models. 2026.
MLA (9th ed.) CitationYan, Yuming, et al. S-GRPO: Unified Post-Training for Large Vision-Language Models. 2026.
Warning: These citations may not always be 100% accurate.