@misc{indiciae2db66a875383, title = {UNIT: Unifying Image and Text Recognition in One Vision Encoder}, author = {Yi Zhu and Yanpeng Zhou and Chunwei Wang and Yang Cao and Jianhua Han and Lu Hou and Hang Xu}, year = {2024}, url = {https://arxiv.org/abs/2409.04095}, note = {Source identifier: 2409.04095} }