TY - RPRT TI - RLFR: Extending Reinforcement Learning for LLMs with Flow Environment AU - Jinghao Zhang AU - Naishan Zheng AU - Ruilin Li AU - Dongzhou Cheng AU - Zheming Liang AU - Feng Zhao AU - Jiaqi Wang PY - 2025 UR - https://arxiv.org/abs/2510.10201 ID - 2510.10201 ER -