TY - RPRT TI - Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning AU - Bidipta Sarkar AU - Warren Xia AU - C. Karen Liu AU - Dorsa Sadigh PY - 2025 UR - https://arxiv.org/abs/2502.06060 ID - 2502.06060 ER -