TY - RPRT TI - Train Less, Learn More: Adaptive Efficient Rollout Optimization for Group-Based Reinforcement Learning AU - Zhi Zhang AU - Zhen Han AU - Costas Mavromatis AU - Qi Zhu AU - Yunyi Zhang AU - Sheng Guan AU - Dingmin Wang AU - Xiong Zhou AU - Shuai Wang AU - Soji Adeshina AU - Vassilis Ioannidis AU - Huzefa Rangwala PY - 2026 UR - https://arxiv.org/abs/2602.14338 ID - 2602.14338 ER -