TY - RPRT TI - Generalization Hacking: Models Can Game Reinforcement Learning by Preventing Behavioral Generalization AU - Frank Xiao AU - Mary Phuong PY - 2026 UR - https://arxiv.org/abs/2606.12016 ID - 2606.12016 ER -