TY - RPRT TI - Provably Efficient Reinforcement Learning with Aggregated States AU - Shi Dong AU - Benjamin Van Roy AU - Zhengyuan Zhou PY - 2020 UR - https://arxiv.org/abs/1912.06366 ID - 1912.06366 ER -