TY - RPRT TI - Towards Deployment-Efficient Reinforcement Learning: Lower Bound and Optimality AU - Jiawei Huang AU - Jinglin Chen AU - Li Zhao AU - Tao Qin AU - Nan Jiang AU - Tie-Yan Liu PY - 2022 UR - https://arxiv.org/abs/2202.06450 ID - 2202.06450 ER -