TY - RPRT TI - Does Scaling Reinforcement Learning Really Require More Training? AU - Bangji Yang AU - Jiajun Fan AU - Hongba Ma AU - Ruihan Guo AU - Ge Liu PY - 2026 UR - https://arxiv.org/abs/2610.01133 ID - 2610.01133 ER -