TY - RPRT TI - Learning at the Right Pace: Adaptive Data Scheduling Improves LLM Reinforcement Learning AU - Zicheng Xu AU - Ruixuan Zhang AU - Yu-Neng Chuang AU - Xiuyi Lou AU - Hoang Anh Duy Le AU - Oren Gal AU - Alexander S. Szalay AU - Zhaozhuo Xu AU - Guanchu Wang AU - Vladimir Braverman PY - 2026 UR - https://arxiv.org/abs/2606.22305 ID - 2606.22305 ER -