TY - RPRT TI - Interactive Learning with Corrective Feedback for Policies based on Deep Neural Networks AU - Rodrigo Pérez-Dattari AU - Carlos Celemin AU - Javier Ruiz-del-Solar AU - Jens Kober PY - 2018 UR - https://arxiv.org/abs/1810.00466 ID - 1810.00466 ER -