TY - RPRT TI - Deployment-Efficient Reinforcement Learning via Model-Based Offline Optimization AU - Tatsuya Matsushima AU - Hiroki Furuta AU - Yutaka Matsuo AU - Ofir Nachum AU - Shixiang Gu PY - 2020 UR - https://arxiv.org/abs/2006.03647 ID - 2006.03647 ER -