TY - RPRT TI - Reinforcement Learning for Slate-based Recommender Systems: A Tractable Decomposition and Practical Methodology AU - Eugene Ie AU - Vihan Jain AU - Jing Wang AU - Sanmit Narvekar AU - Ritesh Agarwal AU - Rui Wu AU - Heng-Tze Cheng AU - Morgane Lustman AU - Vince Gatto AU - Paul Covington AU - Jim McFadden AU - Tushar Chandra AU - Craig Boutilier PY - 2019 UR - https://arxiv.org/abs/1905.12767 ID - 1905.12767 ER -