TY - RPRT TI - Can Prompt Difficulty be Online Predicted for Accelerating RL Finetuning of Reasoning Models? AU - Yun Qu AU - Qi Wang AU - Yixiu Mao AU - Vincent Tao Hu AU - Björn Ommer AU - Xiangyang Ji PY - 2026 UR - https://arxiv.org/abs/2507.04632 ID - 2507.04632 ER -