TY - RPRT TI - Benchmark Self-Evolving: A Multi-Agent Framework for Dynamic LLM Evaluation AU - Siyuan Wang AU - Zhuohan Long AU - Zhihao Fan AU - Zhongyu Wei AU - Xuanjing Huang PY - 2024 UR - https://arxiv.org/abs/2402.11443 ID - 2402.11443 ER -