TY - RPRT TI - Vision-Language Models are Zero-Shot Reward Models for Reinforcement Learning AU - Juan Rocamonde AU - Victoriano Montesinos AU - Elvis Nava AU - Ethan Perez AU - David Lindner PY - 2024 UR - https://arxiv.org/abs/2310.12921 ID - 2310.12921 ER -