@misc{indiciae60e12c20d6ad, title = {CoRe: Combined Rewards with Vision-Language Model Feedback for Preference-Aligned Reinforcement Learning}, author = {Hexian Ni and Tao Lu and Yinghao Cai}, year = {2026}, url = {https://arxiv.org/abs/2607.01721}, note = {Source identifier: 2607.01721} }