TY - RPRT TI - Safe Policy Search for Lifelong Reinforcement Learning with Sublinear Regret AU - Haitham Bou Ammar AU - Rasul Tutunov AU - Eric Eaton PY - 2015 UR - https://arxiv.org/abs/1505.05798 ID - 1505.05798 ER -