TY - RPRT TI - Bridging Visual Representation and Reinforcement Learning from Verifiable Rewards in Large Vision-Language Models AU - Yuhang Han AU - Yuyang Wu AU - Zhengbo Jiao AU - Yiyu Wang AU - Xuyang Liu AU - Shaobo Wang AU - Hanlin Xu AU - Xuming Hu AU - Linfeng Zhang PY - 2026 UR - https://arxiv.org/abs/2603.27375 ID - 2603.27375 ER -