TY - RPRT TI - A Theoretical Analysis of Optimistic Proximal Policy Optimization in Linear Markov Decision Processes AU - Han Zhong AU - Tong Zhang PY - 2023 UR - https://arxiv.org/abs/2305.08841 ID - 2305.08841 ER -