TY - RPRT TI - Deep reinforcement learning under signal temporal logic constraints using Lagrangian relaxation AU - Junya Ikemoto AU - Toshimitsu Ushio PY - 2022 DO - 10.1109/access.2022.3218216 UR - https://arxiv.org/abs/2201.08504 ID - 2201.08504 ER -