@misc{indiciae2aae68a193ec, title = {Position-Enhanced Visual Instruction Tuning for Multimodal Large Language Models}, author = {Chi Chen and Ruoyu Qin and Fuwen Luo and Xiaoyue Mi and Peng Li and Maosong Sun and Yang Liu}, year = {2023}, url = {https://arxiv.org/abs/2308.13437}, note = {Source identifier: 2308.13437} }