TY - RPRT TI - Hybrid Value Estimation for Off-policy Evaluation and Offline Reinforcement Learning AU - Xue-Kun Jin AU - Xu-Hui Liu AU - Shengyi Jiang AU - Yang Yu PY - 2022 UR - https://arxiv.org/abs/2206.02000 ID - 2206.02000 ER -