@misc{indiciaec71945561655, title = {Leveraging Visual Tokens for Extended Text Contexts in Multi-Modal Learning}, author = {Alex Jinpeng Wang and Linjie Li and Yiqi Lin and Min Li and Lijuan Wang and Mike Zheng Shou}, year = {2024}, url = {https://arxiv.org/abs/2406.02547}, note = {Source identifier: 2406.02547} }