TY - RPRT TI - HER: Human-like Reasoning and Reinforcement Learning for LLM Role-playing AU - Chengyu Du AU - Xintao Wang AU - Aili Chen AU - Weiyuan Li AU - Rui Xu AU - Junteng Liu AU - Zishan Huang AU - Rong Tian AU - Zijun Sun AU - Yuhao Li AU - Liheng Feng AU - Deming Ding AU - Pengyu Zhao AU - Yanghua Xiao PY - 2026 UR - https://arxiv.org/abs/2601.21459 ID - 2601.21459 ER -