TY - RPRT TI - Large Language Models are Qualified Benchmark Builders: Rebuilding Pre-Training Datasets for Advancing Code Intelligence Tasks AU - Kang Yang AU - Xinjun Mao AU - Shangwen Wang AU - Yanlin Wang AU - Tanghaoran Zhang AU - Bo Lin AU - Yihao Qin AU - Zhang Zhang AU - Yao Lu AU - Kamal Al-Sabahi PY - 2025 UR - https://arxiv.org/abs/2504.19444 ID - 2504.19444 ER -