TY - RPRT TI - Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning AU - Tian Xie AU - Zitian Gao AU - Qingnan Ren AU - Haoming Luo AU - Yuqian Hong AU - Bryan Dai AU - Joey Zhou AU - Kai Qiu AU - Zhirong Wu AU - Chong Luo PY - 2025 UR - https://arxiv.org/abs/2502.14768 ID - 2502.14768 ER -