@misc{indiciae1ba599c9c902, title = {SPEC-RL: Accelerating On-Policy Reinforcement Learning with Speculative Rollouts}, author = {Bingshuai Liu and Ante Wang and Zijun Min and Liang Yao and Haibo Zhang and Yang Liu and Xu Han and Peng Li and Anxiang Zeng and Jinsong Su}, year = {2026}, url = {https://arxiv.org/abs/2509.23232}, note = {Source identifier: 2509.23232} }