@misc{indiciae2cec8f84c6fc, title = {Unified Language-Vision Pretraining in LLM with Dynamic Discrete Visual Tokenization}, author = {Yang Jin and Kun Xu and Liwei Chen and Chao Liao and Jianchao Tan and Quzhe Huang and Bin Chen and Chenyi Lei and An Liu and Chengru Song and Xiaoqiang Lei and Di Zhang and Wenwu Ou and Kun Gai and Yadong Mu}, year = {2024}, url = {https://arxiv.org/abs/2309.04669}, note = {Source identifier: 2309.04669} }