TY - RPRT TI - Reinforcement Learning with Feedback from Multiple Humans with Diverse Skills AU - Taku Yamagata AU - Ryan McConville AU - Raul Santos-Rodriguez PY - 2021 UR - https://arxiv.org/abs/2111.08596 ID - 2111.08596 ER -