TY - RPRT TI - PIPER: Primitive-Informed Preference-based Hierarchical Reinforcement Learning via Hindsight Relabeling AU - Utsav Singh AU - Wesley A. Suttle AU - Brian M. Sadler AU - Vinay P. Namboodiri AU - Amrit Singh Bedi PY - 2024 UR - https://arxiv.org/abs/2404.13423 ID - 2404.13423 ER -