@misc{indiciae20197078e7d8, title = {Shop-R1: Rewarding LLMs to Simulate Human Behavior in Online Shopping via Reinforcement Learning}, author = {Yimeng Zhang and Tian Wang and Jiri Gesi and Ziyi Wang and Yuxuan Lu and Jiacheng Lin and Sinong Zhan and Vianne Gao and Ruochen Jiao and Junze Liu and Kun Qian and Yuxin Tang and Ran Xue and Houyu Zhang and Qingjun Cui and Yufan Guo and Dakuo Wang}, year = {2026}, url = {https://arxiv.org/abs/2507.17842}, note = {Source identifier: 2507.17842} }