TY - RPRT TI - Uniformly Conservative Exploration in Reinforcement Learning AU - Wanqiao Xu AU - Jason Yecheng Ma AU - Kan Xu AU - Hamsa Bastani AU - Osbert Bastani PY - 2023 UR - https://arxiv.org/abs/2110.13060 ID - 2110.13060 ER -