@misc{indiciae03104c8249b7, title = {Mixed-R1: Unified Reward Perspective For Reasoning Capability in Multimodal Large Language Models}, author = {Shilin Xu and Yanwei Li and Rui Yang and Tao Zhang and Yueyi Sun and Wei Chow and Linfeng Li and Hang Song and Qi Xu and Yunhai Tong and Xiangtai Li and Hao Fei}, year = {2025}, url = {https://arxiv.org/abs/2505.24164}, note = {Source identifier: 2505.24164} }