TY - RPRT TI - Efficient Bayesian Policy Reuse with a Scalable Observation Model in Deep Reinforcement Learning AU - Jinmei Liu AU - Zhi Wang AU - Chunlin Chen AU - Daoyi Dong PY - 2023 DO - 10.1109/tnnls.2023.3281604 UR - https://arxiv.org/abs/2204.07729 ID - 2204.07729 ER -