@misc{indiciaecece4eeb5d0c, title = {To Mix or To Merge: Toward Multi-Domain Reinforcement Learning for Large Language Models}, author = {Haoqing Wang and Xiang Long and Ziheng Li and Yilong Xu and Tingguang Li and Yehui Tang}, year = {2026}, url = {https://arxiv.org/abs/2602.12566}, note = {Source identifier: 2602.12566} }