TY - RPRT TI - Near-optimal Policy Optimization Algorithms for Learning Adversarial Linear Mixture MDPs AU - Jiafan He AU - Dongruo Zhou AU - Quanquan Gu PY - 2022 UR - https://arxiv.org/abs/2102.08940 ID - 2102.08940 ER -