TY - RPRT TI - The Representation-Rationalizability Tradeoff in Reward Learning AU - Jing Dong AU - Yaoliang Yu AU - Pascal Pourpart PY - 2026 UR - https://arxiv.org/abs/2606.00291 ID - 2606.00291 ER -