TY - RPRT TI - A Differentiated Reward Method for Reinforcement Learning based Multi-Vehicle Cooperative Decision-Making Algorithms AU - Ye Han AU - Lijun Zhang AU - Dejian Meng AU - Zhuang Zhang PY - 2025 UR - https://arxiv.org/abs/2502.00352 ID - 2502.00352 ER -