TY - RPRT TI - Vision-R1: Evolving Human-Free Alignment in Large Vision-Language Models via Vision-Guided Reinforcement Learning AU - Yufei Zhan AU - Yousong Zhu AU - Shurong Zheng AU - Hongyin Zhao AU - Fan Yang AU - Ming Tang AU - Jinqiao Wang PY - 2025 UR - https://arxiv.org/abs/2503.18013 ID - 2503.18013 ER -