@misc{indiciae748a52bce374, title = {Maximizing Alignment with Minimal Feedback: Efficiently Learning Rewards for Visuomotor Robot Policy Alignment}, author = {Ran Tian and Yilin Wu and Chenfeng Xu and Masayoshi Tomizuka and Jitendra Malik and Andrea Bajcsy}, year = {2024}, url = {https://arxiv.org/abs/2412.04835}, note = {Source identifier: 2412.04835} }