TY - RPRT TI - SwS: Self-aware Weakness-driven Problem Synthesis in Reinforcement Learning for LLM Reasoning AU - Xiao Liang AU - Zhong-Zhi Li AU - Yeyun Gong AU - Yang Wang AU - Hengyuan Zhang AU - Yelong Shen AU - Ying Nian Wu AU - Weizhu Chen PY - 2025 UR - https://arxiv.org/abs/2506.08989 ID - 2506.08989 ER -