TY - RPRT TI - Replicating Complex Dialogue Policy of Humans via Offline Imitation Learning with Supervised Regularization AU - Zhoujian Sun AU - Chenyang Zhao AU - Zhengxing Huang AU - Nai Ding PY - 2023 UR - https://arxiv.org/abs/2305.03987 ID - 2305.03987 ER -