TY - RPRT TI - OpenReward: Learning to Reward Long-form Agentic Tasks via Reinforcement Learning AU - Ziyou Hu AU - Zhengliang Shi AU - Minghang Zhu AU - Haitao Li AU - Teng Sun AU - Pengjie Ren AU - Suzan Verberne AU - Zhaochun Ren PY - 2026 UR - https://arxiv.org/abs/2510.24636 ID - 2510.24636 ER -