TY - RPRT TI - Efficient, Low-Regret, Online Reinforcement Learning for Linear MDPs AU - Philips George John AU - Arnab Bhattacharyya AU - Silviu Maniu AU - Dimitrios Myrisiotis AU - Zhenan Wu PY - 2024 UR - https://arxiv.org/abs/2411.10906 ID - 2411.10906 ER -