TY - RPRT TI - Towards Optimal Regret in Adversarial Linear MDPs with Bandit Feedback AU - Haolin Liu AU - Chen-Yu Wei AU - Julian Zimmert PY - 2023 UR - https://arxiv.org/abs/2310.11550 ID - 2310.11550 ER -