TY - RPRT TI - Tight Regret Bounds for Model-Based Reinforcement Learning with Greedy Policies AU - Yonathan Efroni AU - Nadav Merlis AU - Mohammad Ghavamzadeh AU - Shie Mannor PY - 2019 UR - https://arxiv.org/abs/1905.11527 ID - 1905.11527 ER -