@misc{indiciaed6c3698a28ca, title = {Fishing Out Free Riders: Shapley-Based Reward Attribution for Parallel Reasoning via Reinforcement Learning}, author = {Wentao Zhang and Haoyu Zhang and Xinke Jiang and Yuxuan Cheng and Yuhan Pan and Miao Li and Zhipeng Qiao and Tao Feng and Zhen Tao and Dengji Zhao}, year = {2026}, url = {https://arxiv.org/abs/2607.18979}, note = {Source identifier: 2607.18979} }