TY - RPRT TI - Learning Policies for Markov Decision Processes from Data AU - Manjesh K. Hanawal AU - Hao Liu AU - Henghui Zhu AU - Ioannis Ch. Paschalidis PY - 2017 UR - https://arxiv.org/abs/1701.05954 ID - 1701.05954 ER -