TY - RPRT TI - Why Reinforcement Fine-Tuning Enables MLLMs Preserve Prior Knowledge Better: A Data Perspective AU - Zhihao Zhang AU - Qiaole Dong AU - Qi Zhang AU - Jun Zhao AU - Enyu Zhou AU - Zhiheng Xi AU - Senjie Jin AU - Xiaoran Fan AU - Yuhao Zhou AU - Mingqi Wu AU - Yanwei Fu AU - Tao Ji AU - Tao Gui AU - Xuanjing Huang AU - Kai Chen PY - 2026 UR - https://arxiv.org/abs/2506.23508 ID - 2506.23508 ER -