TY - RPRT TI - A Near-Optimal Algorithm for Safe Reinforcement Learning Under Instantaneous Hard Constraints AU - Ming Shi AU - Yingbin Liang AU - Ness Shroff PY - 2023 UR - https://arxiv.org/abs/2302.04375 ID - 2302.04375 ER -