TY - RPRT TI - Fishing Out Free Riders: Shapley-Based Reward Attribution for Parallel Reasoning via Reinforcement Learning AU - Wentao Zhang AU - Haoyu Zhang AU - Xinke Jiang AU - Yuxuan Cheng AU - Yuhan Pan AU - Miao Li AU - Zhipeng Qiao AU - Tao Feng AU - Zhen Tao AU - Dengji Zhao PY - 2026 UR - https://arxiv.org/abs/2607.18979 ID - 2607.18979 ER -