TY - RPRT TI - RLAR: An Agentic Reward System for Multi-task Reinforcement Learning on Large Language Models AU - Andrew Zhuoer Feng AU - Cunxiang Wang AU - Bosi Wen AU - Yidong Wang AU - Yu Luo AU - Hongning Wang AU - Minlie Huang PY - 2026 UR - https://arxiv.org/abs/2603.00724 ID - 2603.00724 ER -