@misc{indiciae5cb4b4874c64, title = {LLaVA-Read: Enhancing Reading Ability of Multimodal Language Models}, author = {Ruiyi Zhang and Yufan Zhou and Jian Chen and Jiuxiang Gu and Changyou Chen and Tong Sun}, year = {2024}, url = {https://arxiv.org/abs/2407.19185}, note = {Source identifier: 2407.19185} }