TY - RPRT TI - Joint Differentiable Optimization and Verification for Certified Reinforcement Learning AU - Yixuan Wang AU - Simon Zhan AU - Zhilu Wang AU - Chao Huang AU - Zhaoran Wang AU - Zhuoran Yang AU - Qi Zhu PY - 2023 UR - https://arxiv.org/abs/2201.12243 ID - 2201.12243 ER -