@misc{indiciae4d13c1a08ed6, title = {Reverse Engineering Human Preferences with Reinforcement Learning}, author = {Lisa Alazraki and Tan Yi-Chern and Jon Ander Campos and Maximilian Mozes and Marek Rei and Max Bartolo}, year = {2026}, url = {https://arxiv.org/abs/2505.15795}, note = {Source identifier: 2505.15795} }