TY - RPRT TI - Improve Robustness of Reinforcement Learning against Observation Perturbations via $l_\infty$ Lipschitz Policy Networks AU - Buqing Nie AU - Jingtian Ji AU - Yangqing Fu AU - Yue Gao PY - 2023 UR - https://arxiv.org/abs/2312.08751 ID - 2312.08751 ER -