TY - RPRT TI - Generalization Limits of Reinforcement Learning Alignment AU - Haruhi Shida AU - Koo Imai AU - Keigo Kansa PY - 2026 UR - https://arxiv.org/abs/2604.02652 ID - 2604.02652 ER -