TY - RPRT TI - Effective Policy Learning for Multi-Agent Online Coordination Beyond Submodular Objectives AU - Qixin Zhang AU - Yan Sun AU - Can Jin AU - Xikun Zhang AU - Yao Shu AU - Puning Zhao AU - Li Shen AU - Dacheng Tao PY - 2025 UR - https://arxiv.org/abs/2509.22596 ID - 2509.22596 ER -