@misc{indiciaea20162bb86e9, title = {Each Prompt Matters: Scaling Reinforcement Learning Without Wasting Rollouts on Hundred-Billion-Scale MoE}, author = {Anxiang Zeng and Haibo Zhang and Hailing Zhang and Kaixiang Mo and Liang Yao and Ling Hu and Long Zhang and Shuman Liu and Shuyi Xie and Yanshi Li and Yizhang Chen and Yuepeng Sheng and Yuwei Huang and Zhaochen Xu and Zhiqiang Zhou and Ziqin Liew}, year = {2025}, url = {https://arxiv.org/abs/2512.07710}, note = {Source identifier: 2512.07710} }