TY - RPRT TI - Finding good policies in average-reward Markov Decision Processes without prior knowledge AU - Adrienne Tuynman AU - Rémy Degenne AU - Emilie Kaufmann PY - 2024 UR - https://arxiv.org/abs/2405.17108 ID - 2405.17108 ER -