TY - RPRT TI - StepCodeReasoner: Aligning Code Reasoning with Stepwise Execution Traces via Reinforcement Learning AU - Hao Wang AU - Rui Li AU - Lei Sha AU - Jie M. Zhang PY - 2026 UR - https://arxiv.org/abs/2605.11922 ID - 2605.11922 ER -