@misc{indiciaec779f1b231c4, title = {SAILViT: Towards Robust and Generalizable Visual Backbones for MLLMs via Gradual Feature Refinement}, author = {Weijie Yin and Dingkang Yang and Hongyuan Dong and Zijian Kang and Jiacong Wang and Xiao Liang and Chao Feng and Jiao Ran}, year = {2025}, url = {https://arxiv.org/abs/2507.01643}, note = {Source identifier: 2507.01643} }