TY - RPRT TI - Scheduling Your LLM Reinforcement Learning with Reasoning Trees AU - Hong Wang AU - Zhezheng Hao AU - Jian Luo AU - Chenxing Wei AU - Yao Shu AU - Lei Liu AU - Qiang Lin AU - Hande Dong AU - Jiawei Chen PY - 2026 UR - https://arxiv.org/abs/2510.24832 ID - 2510.24832 ER -