TY - RPRT TI - Reinforcement Learning algorithms for regret minimization in structured Markov Decision Processes AU - K J Prabuchandran AU - Tejas Bodas AU - Theja Tulabandhula PY - 2016 UR - https://arxiv.org/abs/1608.04929 ID - 1608.04929 ER -