TY - RPRT TI - Approximate Policy Iteration with a Policy Language Bias: Solving Relational Markov Decision Processes AU - A. Fern AU - R. Givan AU - S. Yoon PY - 2011 DO - 10.1613/jair.1700 UR - https://arxiv.org/abs/1109.2156 ID - 1109.2156 ER -