@misc{indiciaeebb3b04baa11, title = {SR-GRPO: Stable Rank as an Intrinsic Geometric Reward for Large Language Model Alignment}, author = {Yixuan Tang and Yi Yang}, year = {2025}, url = {https://arxiv.org/abs/2512.02807}, note = {Source identifier: 2512.02807} }