TY - RPRT TI - On The Convergence Of Policy Iteration-Based Reinforcement Learning With Monte Carlo Policy Evaluation AU - Anna Winnicki AU - R. Srikant PY - 2023 UR - https://arxiv.org/abs/2301.09709 ID - 2301.09709 ER -