TY - RPRT TI - Enhancing Rating-Based Reinforcement Learning to Effectively Leverage Feedback from Large Vision-Language Models AU - Tung Minh Luu AU - Younghwan Lee AU - Donghoon Lee AU - Sunho Kim AU - Min Jun Kim AU - Chang D. Yoo PY - 2025 UR - https://arxiv.org/abs/2506.12822 ID - 2506.12822 ER -