TY - RPRT TI - Differentiable Trust Region Layers for Deep Reinforcement Learning AU - Fabian Otto AU - Philipp Becker AU - Ngo Anh Vien AU - Hanna Carolin Ziesche AU - Gerhard Neumann PY - 2021 UR - https://arxiv.org/abs/2101.09207 ID - 2101.09207 ER -