TY - RPRT TI - GoLongRL: Capability-Oriented Long Context Reinforcement Learning with Multitask Alignment AU - Minxuan Lv AU - Tiehua Mei AU - Tanlong Du AU - Junmin Chen AU - Zhenpeng Su AU - Ziyang Chen AU - Ziqi Wang AU - Zhennan Wu AU - Ruotong Pan AU - jian Liang AU - Ruiming Tang AU - Han Li PY - 2026 UR - https://arxiv.org/abs/2605.19577 ID - 2605.19577 ER -