@misc{indiciaed29025f312f2, title = {Policy Mirror Descent for Reinforcement Learning: Linear Convergence, New Sampling Complexity, and Generalized Problem Classes}, author = {Guanghui Lan}, year = {2022}, url = {https://arxiv.org/abs/2102.00135}, note = {Source identifier: 2102.00135} }