TY - RPRT TI - J1: Incentivizing Thinking in LLM-as-a-Judge via Reinforcement Learning AU - Chenxi Whitehouse AU - Tianlu Wang AU - Ping Yu AU - Xian Li AU - Jason Weston AU - Ilia Kulikov AU - Swarnadeep Saha PY - 2025 UR - https://arxiv.org/abs/2505.10320 ID - 2505.10320 ER -