TY - RPRT TI - SocialRL: Refining LLMs' Social Intelligence through Multi-turn Reinforcement Learning and Reward Design AU - Jianing Wang AU - Xintao Wang AU - Aili Chen AU - Jie Shi AU - Hongcheng Guo AU - Jun Gao AU - Wenxuan Zhao AU - Chengkun Lang AU - Yuanli Guo AU - Yanghua Xiao PY - 2026 UR - https://arxiv.org/abs/2609.09764 ID - 2609.09764 ER -