TY - RPRT TI - Adaptive Querying for Reward Learning from Human Feedback AU - Yashwanthi Anand AU - Nnamdi Nwagwu AU - Kevin Sabbe AU - Naomi T. Fitter AU - Sandhya Saisubramanian PY - 2026 UR - https://arxiv.org/abs/2412.07990 ID - 2412.07990 ER -