TY - RPRT TI - Predictive Scaling Laws for Efficient GRPO Training of Large Reasoning Models AU - Datta Nimmaturi AU - Vaishnavi Bhargava AU - Rajat Ghosh AU - Johnu George AU - Debojyoti Dutta PY - 2026 UR - https://arxiv.org/abs/2507.18014 ID - 2507.18014 ER -