@misc{indiciae02cfdb2c2b1d, title = {The Perils of Optimizing Learned Reward Functions: Low Training Error Does Not Guarantee Low Regret}, author = {Lukas Fluri and Leon Lang and Alessandro Abate and Patrick Forré and David Krueger and Joar Skalse}, year = {2025}, url = {https://arxiv.org/abs/2406.15753}, note = {Source identifier: 2406.15753} }