TY - RPRT TI - Teaching LLM to Reason: Reinforcement Learning from Algorithmic Problems without Code AU - Keqin Bao AU - Nuo Chen AU - Xiaoyuan Li AU - Binyuan Hui AU - Bowen Yu AU - Fuli Feng AU - Xiangnan He AU - Dayiheng Liu PY - 2025 UR - https://arxiv.org/abs/2507.07498 ID - 2507.07498 ER -