TY - RPRT TI - Reinforcement Learning in a Safety-Embedded MDP with Trajectory Optimization AU - Fan Yang AU - Wenxuan Zhou AU - Zuxin Liu AU - Ding Zhao AU - David Held PY - 2024 UR - https://arxiv.org/abs/2310.06903 ID - 2310.06903 ER -