TY - RPRT TI - Mixture-of-World Models: Scaling Multi-Task Reinforcement Learning with Modular Latent Dynamics AU - Boxuan Zhang AU - Weipu Zhang AU - Zhaohan Feng AU - Wei Xiao AU - Jian Sun AU - Jie Chen AU - Gang Wang PY - 2026 UR - https://arxiv.org/abs/2602.01270 ID - 2602.01270 ER -