TY - RPRT TI - Teach a Reward Model to Correct Itself: Reward Guided Adversarial Failure Discovery for Robust Reward Modeling AU - Pankayaraj Pathmanathan AU - Furong Huang PY - 2026 UR - https://arxiv.org/abs/2507.06419 ID - 2507.06419 ER -