TY - RPRT TI - Adversarial Advantage Actor-Critic Model for Task-Completion Dialogue Policy Learning AU - Baolin Peng AU - Xiujun Li AU - Jianfeng Gao AU - Jingjing Liu AU - Yun-Nung Chen AU - Kam-Fai Wong PY - 2018 UR - https://arxiv.org/abs/1710.11277 ID - 1710.11277 ER -