TY - RPRT TI - DQN-TAMER: Human-in-the-Loop Reinforcement Learning with Intractable Feedback AU - Riku Arakawa AU - Sosuke Kobayashi AU - Yuya Unno AU - Yuta Tsuboi AU - Shin-ichi Maeda PY - 2018 UR - https://arxiv.org/abs/1810.11748 ID - 1810.11748 ER -