TY - RPRT TI - Reinforcement Fine-Tuning Naturally Mitigates Forgetting in Continual Post-Training AU - Song Lai AU - Haohan Zhao AU - Rong Feng AU - Changyi Ma AU - Wenzhuo Liu AU - Hongbo Zhao AU - Xi Lin AU - Dong Yi AU - Qingfu Zhang AU - Hongbin Liu AU - Gaofeng Meng AU - Fei Zhu PY - 2026 UR - https://arxiv.org/abs/2507.05386 ID - 2507.05386 ER -