@misc{indiciae1d04d5fd5756, title = {Scalable Vision Language Model Training via High Quality Data Curation}, author = {Hongyuan Dong and Zijian Kang and Weijie Yin and Xiao Liang and Chao Feng and Jiao Ran}, year = {2025}, url = {https://arxiv.org/abs/2501.05952}, note = {Source identifier: 2501.05952} }