TY - RPRT TI - SPEC-RL: Accelerating On-Policy Reinforcement Learning with Speculative Rollouts AU - Bingshuai Liu AU - Ante Wang AU - Zijun Min AU - Liang Yao AU - Haibo Zhang AU - Yang Liu AU - Xu Han AU - Peng Li AU - Anxiang Zeng AU - Jinsong Su PY - 2026 UR - https://arxiv.org/abs/2509.23232 ID - 2509.23232 ER -