@misc{indiciaef43e448c9629, title = {Policy Finetuning: Bridging Sample-Efficient Offline and Online Reinforcement Learning}, author = {Tengyang Xie and Nan Jiang and Huan Wang and Caiming Xiong and Yu Bai}, year = {2022}, url = {https://arxiv.org/abs/2106.04895}, note = {Source identifier: 2106.04895} }