TY - RPRT TI - Bayesian Design Principles for Offline-to-Online Reinforcement Learning AU - Hao Hu AU - Yiqin Yang AU - Jianing Ye AU - Chengjie Wu AU - Ziqing Mai AU - Yujing Hu AU - Tangjie Lv AU - Changjie Fan AU - Qianchuan Zhao AU - Chongjie Zhang PY - 2024 UR - https://arxiv.org/abs/2405.20984 ID - 2405.20984 ER -