@misc{indiciaea88d17b796cb, title = {ProRL: Effective Reinforcement Learning for Proactive Recommendation via Rectified Policy Gradient Estimation}, author = {Hongru Hou and Tiehua Mei and Denghui Geng and Jinhui Huang and Ao Xu and Hengrui Chen and Jiaqing Liang and Deqing Yang}, year = {2026}, url = {https://arxiv.org/abs/2605.28293}, note = {Source identifier: 2605.28293} }