TY - RPRT TI - Beyond Benchmarking: Scenario-Based Evaluation of Large Language Models for Personalized Learning AU - Bo Yuan AU - Jiazi Hu PY - 2026 UR - https://arxiv.org/abs/2509.05346 ID - 2509.05346 ER -