TY - RPRT TI - PersonaEval: Are LLM Evaluators Human Enough to Judge Role-Play? AU - Lingfeng Zhou AU - Jialing Zhang AU - Jin Gao AU - Mohan Jiang AU - Dequan Wang PY - 2025 UR - https://arxiv.org/abs/2508.10014 ID - 2508.10014 ER -