TY - RPRT TI - Provably Feedback-Efficient Reinforcement Learning via Active Reward Learning AU - Dingwen Kong AU - Lin F. Yang PY - 2023 UR - https://arxiv.org/abs/2304.08944 ID - 2304.08944 ER -