TY - RPRT TI - VCRL: Variance-based Curriculum Reinforcement Learning for Large Language Models AU - Guochao Jiang AU - Wenfeng Feng AU - Guofeng Quan AU - Chuzhan Hao AU - Yuewei Zhang AU - Guohua Liu AU - Hao Wang PY - 2025 UR - https://arxiv.org/abs/2509.19803 ID - 2509.19803 ER -