TY - RPRT TI - Policy Finetuning in Reinforcement Learning via Design of Experiments using Offline Data AU - Ruiqi Zhang AU - Andrea Zanette PY - 2023 UR - https://arxiv.org/abs/2307.04354 ID - 2307.04354 ER -