TY - RPRT TI - Reinforcement Learning via AIXI Approximation AU - Joel Veness AU - Kee Siong Ng AU - Marcus Hutter AU - David Silver PY - 2010 UR - https://arxiv.org/abs/1007.2049 ID - 1007.2049 ER -