TY - RPRT TI - Directional Alignment Mitigates Reward Hacking in Reinforcement Learning for Language Models AU - Wenlong Deng AU - Jiaji Huang AU - Kaan Ozkara AU - Yushu Li AU - Christos Thrampoulidis AU - Xiaoxiao Li AU - Youngsuk Park PY - 2026 UR - https://arxiv.org/abs/2605.25189 ID - 2605.25189 ER -