@misc{indiciaeb14592b593a0, title = {MARSHAL: Incentivizing Multi-Agent Reasoning via Self-Play with Strategic LLMs}, author = {Huining Yuan and Zelai Xu and Zheyue Tan and Xiangmin Yi and Mo Guang and Kaiwen Long and Haojia Hui and Boxun Li and Xinlei Chen and Bo Zhao and Xiao-Ping Zhang and Chao Yu and Yu Wang}, year = {2026}, url = {https://arxiv.org/abs/2510.15414}, note = {Source identifier: 2510.15414} }