TY - RPRT TI - REAL: Regression-Aware Reinforcement Learning for LLM-as-a-Judge AU - Yasi Zhang AU - Tianyu Chen AU - Mingyuan Zhou AU - Oscar Leong AU - Ying Nian Wu AU - Michal Lukasik PY - 2026 UR - https://arxiv.org/abs/2603.17145 ID - 2603.17145 ER -