TY - RPRT TI - Stability-Certified Reinforcement Learning via Spectral Normalization AU - Ryoichi Takase AU - Nobuyuki Yoshikawa AU - Toshisada Mariyama AU - Takeshi Tsuchiya PY - 2020 UR - https://arxiv.org/abs/2012.13744 ID - 2012.13744 ER -