TY - RPRT TI - Reinforcement Learning Optimization for Large-Scale Learning: An Efficient and User-Friendly Scaling Library AU - Weixun Wang AU - Shaopan Xiong AU - Gengru Chen AU - Wei Gao AU - Sheng Guo AU - Yancheng He AU - Ju Huang AU - Jiaheng Liu AU - Zhendong Li AU - Xiaoyang Li AU - Zichen Liu AU - Haizhou Zhao AU - Dakai An AU - Lunxi Cao AU - Qiyang Cao AU - Wanxi Deng AU - Feilei Du AU - Yiliang Gu AU - Jiahe Li AU - Xiang Li AU - Mingjie Liu AU - Yijia Luo AU - Zihe Liu AU - Yadao Wang AU - Pei Wang AU - Tianyuan Wu AU - Yanan Wu AU - Yuheng Zhao AU - Shuaibing Zhao AU - Jin Yang AU - Siran Yang AU - Yingshui Tan AU - Huimin Yi AU - Yuchi Xu AU - Yujin Yuan AU - Xingyao Zhang AU - Lin Qu AU - Wenbo Su AU - Wei Wang AU - Jiamang Wang AU - Bo Zheng PY - 2025 UR - https://arxiv.org/abs/2506.06122 ID - 2506.06122 ER -