@misc{indiciaeac9823d45f3b, title = {Enhancing Large Vision Language Models with Self-Training on Image Comprehension}, author = {Yihe Deng and Pan Lu and Fan Yin and Ziniu Hu and Sheng Shen and Quanquan Gu and James Zou and Kai-Wei Chang and Wei Wang}, year = {2024}, url = {https://arxiv.org/abs/2405.19716}, note = {Source identifier: 2405.19716} }