TY - RPRT TI - REGAL: A Regularization based Algorithm for Reinforcement Learning in Weakly Communicating MDPs AU - Peter L. Bartlett AU - Ambuj Tewari PY - 2012 UR - https://arxiv.org/abs/1205.2661 ID - 1205.2661 ER -