TY - RPRT TI - Safe Multi-Agent Reinforcement Learning via Shielding AU - Ingy Elsayed-Aly AU - Suda Bharadwaj AU - Christopher Amato AU - RĂ¼diger Ehlers AU - Ufuk Topcu AU - Lu Feng PY - 2021 UR - https://arxiv.org/abs/2101.11196 ID - 2101.11196 ER -