TY - RPRT TI - Rollout-Training Co-Design for Efficient LLM-Based Multi-Agent Reinforcement Learning AU - Zhida Jiang AU - Zhaolong Xing AU - Jiawei Lu AU - Yipei Niu AU - Qingyuan Sang AU - Liangxu Zhang AU - Wenquan Dai AU - Junhua Shu AU - Jiaxing Wang AU - Qiangyu Pei AU - Qiong Chen AU - Xinyu Liu AU - Fangming Liu AU - Ai Han AU - Zhen Chen AU - Ke Zhang PY - 2026 UR - https://arxiv.org/abs/2602.09578 ID - 2602.09578 ER -