@misc{indiciaea1776876366e, title = {ViCToR: Improving Visual Comprehension via Token Reconstruction for Pretraining LMMs}, author = {Yin Xie and Kaicheng Yang and Peirou Liang and Xiang An and Yongle Zhao and Yumeng Wang and Ziyong Feng and Roy Miles and Ismail Elezi and Jiankang Deng}, year = {2025}, url = {https://arxiv.org/abs/2410.14332}, note = {Source identifier: 2410.14332} }