Tang, Y., & Yang, Y. (2025). SR-GRPO: Stable Rank as an Intrinsic Geometric Reward for Large Language Model Alignment.
Chicago Style (17th ed.) CitationTang, Yixuan, and Yi Yang. SR-GRPO: Stable Rank as an Intrinsic Geometric Reward for Large Language Model Alignment. 2025.
MLA (9th ed.) CitationTang, Yixuan, and Yi Yang. SR-GRPO: Stable Rank as an Intrinsic Geometric Reward for Large Language Model Alignment. 2025.
Warning: These citations may not always be 100% accurate.