TY - RPRT TI - Non-Stationary Markov Decision Processes, a Worst-Case Approach using Model-Based Reinforcement Learning, Extended version AU - Erwan Lecarpentier AU - Emmanuel Rachelson PY - 2020 UR - https://arxiv.org/abs/1904.10090 ID - 1904.10090 ER -