TY - RPRT TI - The Perils of Optimizing Learned Reward Functions: Low Training Error Does Not Guarantee Low Regret AU - Lukas Fluri AU - Leon Lang AU - Alessandro Abate AU - Patrick Forré AU - David Krueger AU - Joar Skalse PY - 2025 UR - https://arxiv.org/abs/2406.15753 ID - 2406.15753 ER -