TY - RPRT TI - Continuous-time reinforcement learning for optimal switching over multiple regimes AU - Yijie Huang AU - Mengge Li AU - Xiang Yu AU - Zhou Zhou PY - 2026 UR - https://arxiv.org/abs/2512.04697 ID - 2512.04697 ER -