TY - RPRT TI - Generating Self-Contained and Summary-Centric Question Answer Pairs via Differentiable Reward Imitation Learning AU - Li Zhou AU - Kevin Small AU - Yong Zhang AU - Sandeep Atluri PY - 2021 UR - https://arxiv.org/abs/2109.04689 ID - 2109.04689 ER -