TY - RPRT TI - Step-Level Preference Learning for Generative Agents in Social Simulations AU - Wenchang Gao AU - Pingyue Sheng AU - Lanlan Qiu AU - Yunfei Ma AU - Jian Zhao AU - Baicheng Chen AU - Kangda Wang AU - Yuyang Tian AU - Shunqiang Mao AU - Tianxing He PY - 2026 UR - https://arxiv.org/abs/2607.14485 ID - 2607.14485 ER -