TY - RPRT TI - Composite Task-Completion Dialogue Policy Learning via Hierarchical Deep Reinforcement Learning AU - Baolin Peng AU - Xiujun Li AU - Lihong Li AU - Jianfeng Gao AU - Asli Celikyilmaz AU - Sungjin Lee AU - Kam-Fai Wong PY - 2017 UR - https://arxiv.org/abs/1704.03084 ID - 1704.03084 ER -