TY - RPRT TI - Optimism and Delays in Episodic Reinforcement Learning AU - Benjamin Howson AU - Ciara Pike-Burke AU - Sarah Filippi PY - 2023 UR - https://arxiv.org/abs/2111.07615 ID - 2111.07615 ER -