@misc{indiciaec7546e67f702, title = {VisualAgentBench: Towards Large Multimodal Models as Visual Foundation Agents}, author = {Xiao Liu and Tianjie Zhang and Yu Gu and Iat Long Iong and Yifan Xu and Xixuan Song and Shudan Zhang and Hanyu Lai and Xinyi Liu and Hanlin Zhao and Jiadai Sun and Xinyue Yang and Yu Yang and Zehan Qi and Shuntian Yao and Xueqiao Sun and Siyi Cheng and Qinkai Zheng and Hao Yu and Hanchen Zhang and Wenyi Hong and Ming Ding and Lihang Pan and Xiaotao Gu and Aohan Zeng and Zhengxiao Du and Chan Hee Song and Yu Su and Yuxiao Dong and Jie Tang}, year = {2024}, url = {https://arxiv.org/abs/2408.06327}, note = {Source identifier: 2408.06327} }