TY - RPRT TI - Maximizing Alignment with Minimal Feedback: Efficiently Learning Rewards for Visuomotor Robot Policy Alignment AU - Ran Tian AU - Yilin Wu AU - Chenfeng Xu AU - Masayoshi Tomizuka AU - Jitendra Malik AU - Andrea Bajcsy PY - 2024 UR - https://arxiv.org/abs/2412.04835 ID - 2412.04835 ER -