TY - RPRT TI - Mitigating Overthinking in Large Reasoning Models via Difficulty-aware Reinforcement Learning AU - Qian Wan AU - Ziao Xu AU - Luona Wei AU - Xiaoxuan Shen AU - Jianwen Sun PY - 2026 UR - https://arxiv.org/abs/2601.21418 ID - 2601.21418 ER -