@misc{indiciae0633c1816cd9, title = {Vision-R1: Evolving Human-Free Alignment in Large Vision-Language Models via Vision-Guided Reinforcement Learning}, author = {Yufei Zhan and Yousong Zhu and Shurong Zheng and Hongyin Zhao and Fan Yang and Ming Tang and Jinqiao Wang}, year = {2025}, url = {https://arxiv.org/abs/2503.18013}, note = {Source identifier: 2503.18013} }