TY - RPRT TI - Learning Humanoid Robot Running Skills through Proximal Policy Optimization AU - Luckeciano C. Melo AU - Marcos R. O. A. Maximo PY - 2019 UR - https://arxiv.org/abs/1910.10620 ID - 1910.10620 ER -