TY - RPRT TI - Multi-Objective Multi-Agent Bandits: From Learning Efficiency to Fairness Optimization AU - John Wang AU - Mengfan Xu PY - 2026 UR - https://arxiv.org/abs/2605.06864 ID - 2605.06864 ER -