TY - RPRT TI - SURF: Semi-supervised Reward Learning with Data Augmentation for Feedback-efficient Preference-based Reinforcement Learning AU - Jongjin Park AU - Younggyo Seo AU - Jinwoo Shin AU - Honglak Lee AU - Pieter Abbeel AU - Kimin Lee PY - 2022 UR - https://arxiv.org/abs/2203.10050 ID - 2203.10050 ER -