TY - RPRT TI - Provably Efficient Information-Directed Sampling Algorithms for Multi-Agent Reinforcement Learning AU - Qiaosheng Zhang AU - Chenjia Bai AU - Shuyue Hu AU - Zhen Wang AU - Xuelong Li PY - 2024 UR - https://arxiv.org/abs/2404.19292 ID - 2404.19292 ER -