TY - RPRT TI - A Survey of Slow Thinking-based Reasoning LLMs using Reinforced Learning and Inference-time Scaling Law AU - Qianjun Pan AU - Wenkai Ji AU - Yuyang Ding AU - Junsong Li AU - Shilian Chen AU - Junyi Wang AU - Jie Zhou AU - Qin Chen AU - Min Zhang AU - Yulan Wu AU - Liang He PY - 2025 UR - https://arxiv.org/abs/2505.02665 ID - 2505.02665 ER -