@misc{indiciae72f7aba6b43f, title = {Vision Language Models are In-Context Value Learners}, author = {Yecheng Jason Ma and Joey Hejna and Ayzaan Wahid and Chuyuan Fu and Dhruv Shah and Jacky Liang and Zhuo Xu and Sean Kirmani and Peng Xu and Danny Driess and Ted Xiao and Jonathan Tompson and Osbert Bastani and Dinesh Jayaraman and Wenhao Yu and Tingnan Zhang and Dorsa Sadigh and Fei Xia}, year = {2024}, url = {https://arxiv.org/abs/2411.04549}, note = {Source identifier: 2411.04549} }