TY - RPRT TI - Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models AU - Haoyuan Sun AU - Jiaqi Wu AU - Bo Xia AU - Yifu Luo AU - Yifei Zhao AU - Kai Qin AU - Xufei Lv AU - Tiantian Zhang AU - Yongzhe Chang AU - Xueqian Wang PY - 2025 UR - https://arxiv.org/abs/2505.18536 ID - 2505.18536 ER -