TY - RPRT TI - A Decentralized Policy with Logarithmic Regret for a Class of Multi-Agent Multi-Armed Bandit Problems with Option Unavailability Constraints and Stochastic Communication Protocols AU - Pathmanathan Pankayaraj AU - D. H. S. Maithripala AU - J. M. Berg PY - 2020 UR - https://arxiv.org/abs/2003.12968 ID - 2003.12968 ER -