TY - RPRT TI - Training Agents using Upside-Down Reinforcement Learning AU - Rupesh Kumar Srivastava AU - Pranav Shyam AU - Filipe Mutz AU - Wojciech Jaśkowski AU - Jürgen Schmidhuber PY - 2021 UR - https://arxiv.org/abs/1912.02877 ID - 1912.02877 ER -