TY - RPRT TI - DIRECT: Learning from Sparse and Shifting Rewards using Discriminative Reward Co-Training AU - Philipp Altmann AU - Thomy Phan AU - Fabian Ritz AU - Thomas Gabor AU - Claudia Linnhoff-Popien PY - 2023 UR - https://arxiv.org/abs/2301.07421 ID - 2301.07421 ER -