TY - RPRT TI - Rethinking the Sampling Criteria in Reinforcement Learning for LLM Reasoning: A Competence-Difficulty Alignment Perspective AU - Deyang Kong AU - Qi Guo AU - Xiangyu Xi AU - Wei Wang AU - Jingang Wang AU - Xunliang Cai AU - Shikun Zhang AU - Wei Ye PY - 2026 UR - https://arxiv.org/abs/2505.17652 ID - 2505.17652 ER -