@misc{indiciae6825a90b71f6, title = {Don't Mix Rewards, Mix Policies: Policy Decomposition and Optimization for Multi-Reward RL}, author = {Ruiming Liang and Yi Zhong and Yizhen Yuan and Yinan Zheng and Tianyi Tan and Tianyue Wang and Haiyun Guo and Jinqiao Wang and Xianyuan Zhan}, year = {2026}, url = {https://arxiv.org/abs/2607.29246}, note = {Source identifier: 2607.29246} }