@misc{indiciaea0d88beaa620, title = {Modification-Considering Value Learning for Reward Hacking Mitigation in RL}, author = {Evgenii Opryshko and Umangi Jain and Igor Gilitschenski}, year = {2026}, url = {https://arxiv.org/abs/2606.28955}, note = {Source identifier: 2606.28955} }