@misc{indiciaee0c71f5962f4, title = {One Model, All Roles: Multi-Turn, Multi-Agent Self-Play Reinforcement Learning for Conversational Social Intelligence}, author = {Bowen Jiang and Taiwei Shi and Ryo Kamoi and Yuan Yuan and Camillo J. Taylor and Longqi Yang and Pei Zhou and Sihao Chen}, year = {2026}, url = {https://arxiv.org/abs/2602.03109}, note = {Source identifier: 2602.03109} }