TY - RPRT TI - Offline Reinforcement Learning with On-Policy Q-Function Regularization AU - Laixi Shi AU - Robert Dadashi AU - Yuejie Chi AU - Pablo Samuel Castro AU - Matthieu Geist PY - 2023 UR - https://arxiv.org/abs/2307.13824 ID - 2307.13824 ER -