TY - RPRT TI - Improving the Exploration of Deep Reinforcement Learning in Continuous Domains using Planning for Policy Search AU - Jakob J. Hollenstein AU - Erwan Renaudo AU - Matteo Saveriano AU - Justus Piater PY - 2020 UR - https://arxiv.org/abs/2010.12974 ID - 2010.12974 ER -