TY - RPRT TI - Adaptive Social Learning via Mode Policy Optimization for Language Agents AU - Minzheng Wang AU - Yongbin Li AU - Haobo Wang AU - Xinghua Zhang AU - Nan Xu AU - Bingli Wu AU - Fei Huang AU - Haiyang Yu AU - Wenji Mao PY - 2026 UR - https://arxiv.org/abs/2505.02156 ID - 2505.02156 ER -