TY - RPRT TI - From Captions to Rewards (CAREVL): Leveraging Large Language Model Experts for Enhanced Reward Modeling in Large Vision-Language Models AU - Muzhi Dai AU - Jiashuo Sun AU - Zhiyuan Zhao AU - Shixuan Liu AU - Rui Li AU - Junyu Gao AU - Xuelong Li PY - 2025 UR - https://arxiv.org/abs/2503.06260 ID - 2503.06260 ER -