TY - RPRT TI - Optimizing Dialogue Management with Reinforcement Learning: Experiments with the NJFun System AU - M. Kearns AU - D. Litman AU - S. Singh AU - M. Walker PY - 2011 DO - 10.1613/jair.859 UR - https://arxiv.org/abs/1106.0676 ID - 1106.0676 ER -