@misc{indiciaee32c9ab947cd, title = {StepHint: Multi-level Stepwise Hints Enhance Reinforcement Learning to Reason}, author = {Kaiyi Zhang and Ang Lv and Jinpeng Li and Yongbo Wang and Feng Wang and Haoyuan Hu and Rui Yan}, year = {2025}, url = {https://arxiv.org/abs/2507.02841}, note = {Source identifier: 2507.02841} }