TY - RPRT TI - Parallel-R1: Towards Parallel Thinking via Reinforcement Learning AU - Tong Zheng AU - Hongming Zhang AU - Wenhao Yu AU - Xiaoyang Wang AU - Runpeng Dai AU - Rui Liu AU - Huiwen Bao AU - Chengsong Huang AU - Heng Huang AU - Dong Yu PY - 2025 UR - https://arxiv.org/abs/2509.07980 ID - 2509.07980 ER -