TY - RPRT TI - ORION: Option-Regularized Deep Reinforcement Learning for Cooperative Multi-Agent Online Navigation AU - Shizhe Zhang AU - Jingsong Liang AU - Zhitao Zhou AU - Shuhan Ye AU - Yizhuo Wang AU - Ming Siang Derek Tan AU - Jimmy Chiun AU - Yuhong Cao AU - Guillaume Sartoretti PY - 2026 UR - https://arxiv.org/abs/2601.01155 ID - 2601.01155 ER -