TY - RPRT TI - Unlock the Correlation between Supervised Fine-Tuning and Reinforcement Learning in Training Code Large Language Models AU - Jie Chen AU - Xintian Han AU - Yu Ma AU - Xun Zhou AU - Liang Xiang PY - 2024 UR - https://arxiv.org/abs/2406.10305 ID - 2406.10305 ER -