TY - RPRT TI - Learning-Based Mean-Payoff Optimization in an Unknown MDP under Omega-Regular Constraints AU - Jan Křetínský AU - Guillermo A. Pérez AU - Jean-François Raskin PY - 2018 UR - https://arxiv.org/abs/1804.08924 ID - 1804.08924 ER -