TY - RPRT TI - R1-ShareVL: Incentivizing Reasoning Capability of Multimodal Large Language Models via Share-GRPO AU - Huanjin Yao AU - Qixiang Yin AU - Jingyi Zhang AU - Min Yang AU - Yibo Wang AU - Wenhao Wu AU - Fei Su AU - Li Shen AU - Minghui Qiu AU - Dacheng Tao AU - Jiaxing Huang PY - 2025 UR - https://arxiv.org/abs/2505.16673 ID - 2505.16673 ER -