TY - RPRT TI - Quasi-optimal Reinforcement Learning with Continuous Actions AU - Yuhan Li AU - Wenzhuo Zhou AU - Ruoqing Zhu PY - 2023 UR - https://arxiv.org/abs/2301.08940 ID - 2301.08940 ER -