TY - RPRT TI - Learning to Win, Lose and Cooperate through Reward Signal Evolution AU - Rafal Muszynski AU - Katja Hofmann AU - Jun Wang PY - 2021 UR - https://arxiv.org/abs/2105.08187 ID - 2105.08187 ER -