TY - RPRT TI - VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning AU - Haozhe Wang AU - Chao Qu AU - Zuming Huang AU - Wei Chu AU - Fangzhen Lin AU - Wenhu Chen PY - 2025 UR - https://arxiv.org/abs/2504.08837 ID - 2504.08837 ER -