TY - RPRT TI - Reinforcement Learning with a Corrupted Reward Channel AU - Tom Everitt AU - Victoria Krakovna AU - Laurent Orseau AU - Marcus Hutter AU - Shane Legg PY - 2017 UR - https://arxiv.org/abs/1705.08417 ID - 1705.08417 ER -