TY - RPRT TI - Counting Reward Automata: Sample Efficient Reinforcement Learning Through the Exploitation of Reward Function Structure AU - Tristan Bester AU - Benjamin Rosman AU - Steven James AU - Geraud Nangue Tasse PY - 2024 UR - https://arxiv.org/abs/2312.11364 ID - 2312.11364 ER -