TY - RPRT TI - Deep Reinforcement Learning for Chatbots Using Clustered Actions and Human-Likeness Rewards AU - Heriberto CuayƔhuitl AU - Donghyeon Lee AU - Seonghan Ryu AU - Sungja Choi AU - Inchul Hwang AU - Jihie Kim PY - 2019 UR - https://arxiv.org/abs/1908.10331 ID - 1908.10331 ER -