TY - RPRT TI - Information Directed Reward Learning for Reinforcement Learning AU - David Lindner AU - Matteo Turchetta AU - Sebastian Tschiatschek AU - Kamil Ciosek AU - Andreas Krause PY - 2022 UR - https://arxiv.org/abs/2102.12466 ID - 2102.12466 ER -