TY - RPRT TI - Reinforcement Learning: Stochastic Approximation Algorithms for Markov Decision Processes AU - Vikram Krishnamurthy PY - 2015 UR - https://arxiv.org/abs/1512.07669 ID - 1512.07669 ER -