@misc{indiciae4abd93703f56, title = {DIPPER: Direct Preference Optimization to Accelerate Primitive-Enabled Hierarchical Reinforcement Learning}, author = {Utsav Singh and Souradip Chakraborty and Wesley A. Suttle and Brian M. Sadler and Vinay P Namboodiri and Amrit Singh Bedi}, year = {2024}, url = {https://arxiv.org/abs/2406.10892}, note = {Source identifier: 2406.10892} }