TY - RPRT TI - SR-GRPO: Stable Rank as an Intrinsic Geometric Reward for Large Language Model Alignment AU - Yixuan Tang AU - Yi Yang PY - 2025 UR - https://arxiv.org/abs/2512.02807 ID - 2512.02807 ER -