TY - RPRT TI - Finetuning from Offline Reinforcement Learning: Challenges, Trade-offs and Practical Solutions AU - Yicheng Luo AU - Jackie Kay AU - Edward Grefenstette AU - Marc Peter Deisenroth PY - 2023 UR - https://arxiv.org/abs/2303.17396 ID - 2303.17396 ER -