TY - RPRT TI - T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling AU - Zhenyu Hou AU - Xin Lv AU - Rui Lu AU - Jiajie Zhang AU - Yujiang Li AU - Zijun Yao AU - Juanzi Li AU - Jie Tang AU - Yuxiao Dong PY - 2025 UR - https://arxiv.org/abs/2501.11651 ID - 2501.11651 ER -