TY - RPRT TI - RLinf: Flexible and Efficient Large-scale Reinforcement Learning via Macro-to-Micro Flow Transformation AU - Chao Yu AU - Yuanqing Wang AU - Zhen Guo AU - Hao Lin AU - Si Xu AU - Hongzhi Zang AU - Quanlu Zhang AU - Yongji Wu AU - Chunyang Zhu AU - Junhao Hu AU - Zixiao Huang AU - Mingjie Wei AU - Yuqing Xie AU - Ke Yang AU - Bo Dai AU - Zhexuan Xu AU - Jiakun Du AU - Xiangyuan Wang AU - Xu Fu AU - Letong Shi AU - Zhihao Liu AU - Kang Chen AU - Weilin Liu AU - Gang Liu AU - Boxun Li AU - Jianlei Yang AU - Zhi Yang AU - Guohao Dai AU - Yu Wang PY - 2025 UR - https://arxiv.org/abs/2509.15965 ID - 2509.15965 ER -