@misc{indiciae179d35998319, title = {Towards Stable and Effective Reinforcement Learning for Mixture-of-Experts}, author = {Di Zhang and Xun Wu and Shaohan Huang and Lingjie Jiang and Yaru Hao and Li Dong and Zewen Chi and Zhifang Sui and Furu Wei}, year = {2026}, url = {https://arxiv.org/abs/2510.23027}, note = {Source identifier: 2510.23027} }