TY - RPRT TI - From Reasoning Chains to Verifiable Subproblems: Curriculum Reinforcement Learning Enables Credit Assignment for LLM Reasoning AU - Xitai Jiang AU - Zihan Tang AU - Wenze Lin AU - Yang Yue AU - Shenzhi Wang AU - Gao Huang PY - 2026 UR - https://arxiv.org/abs/2605.22074 ID - 2605.22074 ER -