TY - RPRT TI - Inference-Time Reward Hacking in Large Language Models AU - Hadi Khalaf AU - Claudio Mayrink Verdun AU - Alex Oesterling AU - Himabindu Lakkaraju AU - Flavio du Pin Calmon PY - 2025 UR - https://arxiv.org/abs/2506.19248 ID - 2506.19248 ER -