TY - RPRT TI - LongR: Unleashing Long-Context Reasoning via Reinforcement Learning with Dense Utility Rewards AU - Bowen Ping AU - Zijun Chen AU - Yiyao Yu AU - Tingfeng Hui AU - Junchi Yan AU - Baobao Chang PY - 2026 UR - https://arxiv.org/abs/2602.05758 ID - 2602.05758 ER -