@misc{indiciae01d22a4855d0, title = {RLEP: Reinforcement Learning with Experience Replay for LLM Reasoning}, author = {Hongzhi Zhang and Jia Fu and Jingyuan Zhang and Kai Fu and Qi Wang and Fuzheng Zhang and Guorui Zhou}, year = {2025}, url = {https://arxiv.org/abs/2507.07451}, note = {Source identifier: 2507.07451} }