TY - RPRT TI - SPELL: Self-Play Reinforcement Learning for Evolving Long-Context Language Models AU - Ziyi Yang AU - Weizhou Shen AU - Chenliang Li AU - Ruijun Chen AU - Fanqi Wan AU - Ming Yan AU - Xiaojun Quan AU - Fei Huang PY - 2026 UR - https://arxiv.org/abs/2509.23863 ID - 2509.23863 ER -