TY - RPRT TI - Preference VLM: Leveraging VLMs for Scalable Preference-Based Reinforcement Learning AU - Udita Ghosh AU - Dripta S. Raychaudhuri AU - Jiachen Li AU - Konstantinos Karydis AU - Amit Roy-Chowdhury PY - 2025 UR - https://arxiv.org/abs/2502.01616 ID - 2502.01616 ER -