TY - RPRT TI - Speeding Up the Convergence of Value Iteration in Partially Observable Markov Decision Processes AU - N. L. Zhang AU - W. Zhang PY - 2011 DO - 10.1613/jair.761 UR - https://arxiv.org/abs/1106.0251 ID - 1106.0251 ER -