TY - RPRT TI - Value Iteration for Long-run Average Reward in Markov Decision Processes AU - Pranav Ashok AU - Krishnendu Chatterjee AU - Przemyslaw Daca AU - Jan Křetínský AU - Tobias Meggendorfer PY - 2017 UR - https://arxiv.org/abs/1705.02326 ID - 1705.02326 ER -