TY - RPRT TI - CoRe: Combined Rewards with Vision-Language Model Feedback for Preference-Aligned Reinforcement Learning AU - Hexian Ni AU - Tao Lu AU - Yinghao Cai PY - 2026 UR - https://arxiv.org/abs/2607.01721 ID - 2607.01721 ER -