TY - RPRT TI - Expert Q-learning: Deep Reinforcement Learning with Coarse State Values from Offline Expert Examples AU - Li Meng AU - Anis Yazidi AU - Morten Goodwin AU - Paal Engelstad PY - 2024 DO - 10.7557/18.6237 UR - https://arxiv.org/abs/2106.14642 ID - 2106.14642 ER -