@misc{indiciae85beb03682c6, title = {VersaViT: Enhancing MLLM Vision Backbones via Task-Guided Optimization}, author = {Yikun Liu and Yuan Liu and Shangzhe Di and Haicheng Wang and Zhongyin Zhao and Le Tian and Xiao Zhou and Jie Zhou and Jiangchao Yao and Yanfeng Wang and Weidi Xie}, year = {2026}, url = {https://arxiv.org/abs/2602.09934}, note = {Source identifier: 2602.09934} }