TY - RPRT TI - Solving Stabilize-Avoid Optimal Control via Epigraph Form and Deep Reinforcement Learning AU - Oswin So AU - Chuchu Fan PY - 2023 UR - https://arxiv.org/abs/2305.14154 ID - 2305.14154 ER -