TY - RPRT TI - Human-Level Reinforcement Learning through Theory-Based Modeling, Exploration, and Planning AU - Pedro A. Tsividis AU - Joao Loula AU - Jake Burga AU - Nathan Foss AU - Andres Campero AU - Thomas Pouncy AU - Samuel J. Gershman AU - Joshua B. Tenenbaum PY - 2021 UR - https://arxiv.org/abs/2107.12544 ID - 2107.12544 ER -