TY - RPRT TI - Gaussian Processes for Sample Efficient Reinforcement Learning with RMAX-like Exploration AU - Tobias Jung AU - Peter Stone PY - 2012 UR - https://arxiv.org/abs/1201.6604 ID - 1201.6604 ER -