TY - RPRT TI - Reward Generation via Large Vision-Language Model in Offline Reinforcement Learning AU - Younghwan Lee AU - Tung M. Luu AU - Donghoon Lee AU - Chang D. Yoo PY - 2025 UR - https://arxiv.org/abs/2504.08772 ID - 2504.08772 ER -