TY - RPRT TI - Optimal Learning Dynamics of Multi Agents in Restless Multiarmed Bandit Game AU - Kazuaki Nakayama AU - Ryuzo Nakamura AU - Masato Hisakado AU - Shintaro Mori PY - 2020 DO - 10.1016/j.physa.2020.124314 UR - https://arxiv.org/abs/2001.06244 ID - 2001.06244 ER -