TY - RPRT TI - Real-World Offline Reinforcement Learning from Vision Language Model Feedback AU - Sreyas Venkataraman AU - Yufei Wang AU - Ziyu Wang AU - Navin Sriram Ravie AU - Zackory Erickson AU - David Held PY - 2025 UR - https://arxiv.org/abs/2411.05273 ID - 2411.05273 ER -