TY - RPRT TI - Episodic Reinforcement Learning in Finite MDPs: Minimax Lower Bounds Revisited AU - Omar Darwiche Domingues AU - Pierre Ménard AU - Emilie Kaufmann AU - Michal Valko PY - 2020 UR - https://arxiv.org/abs/2010.03531 ID - 2010.03531 ER -