TY - RPRT TI - Factual and Personalized Recommendations using Language Models and Reinforcement Learning AU - Jihwan Jeong AU - Yinlam Chow AU - Guy Tennenholtz AU - Chih-Wei Hsu AU - Azamat Tulepbergenov AU - Mohammad Ghavamzadeh AU - Craig Boutilier PY - 2023 UR - https://arxiv.org/abs/2310.06176 ID - 2310.06176 ER -