TY - RPRT TI - Bypassing the Simulation-to-reality Gap: Online Reinforcement Learning using a Supervisor AU - Benjamin David Evans AU - Johannes Betz AU - Hongrui Zheng AU - Herman A. Engelbrecht AU - Rahul Mangharam AU - Hendrik W. Jordaan PY - 2023 UR - https://arxiv.org/abs/2209.11082 ID - 2209.11082 ER -