@misc{indiciae463eebef31f1, title = {RecLLM-R1: A Two-Stage Training Paradigm with Reinforcement Learning and Chain-of-Thought v1}, author = {Yu Xie and Xingkai Ren and Ying Qi and Yao Hu and Lianlei Shan}, year = {2025}, url = {https://arxiv.org/abs/2506.19235}, note = {Source identifier: 2506.19235} }