TY - RPRT TI - Expert-Supervised Reinforcement Learning for Offline Policy Learning and Evaluation AU - Aaron Sonabend-W AU - Junwei Lu AU - Leo A. Celi AU - Tianxi Cai AU - Peter Szolovits PY - 2020 UR - https://arxiv.org/abs/2006.13189 ID - 2006.13189 ER -