@misc{indiciae825e8128c1b8, title = {UniToken: Harmonizing Multimodal Understanding and Generation through Unified Visual Encoding}, author = {Yang Jiao and Haibo Qiu and Zequn Jie and Shaoxiang Chen and Jingjing Chen and Lin Ma and Yu-Gang Jiang}, year = {2025}, url = {https://arxiv.org/abs/2504.04423}, note = {Source identifier: 2504.04423} }