@misc{indiciae984c9e6da265, title = {MouSi: Poly-Visual-Expert Vision-Language Models}, author = {Xiaoran Fan and Tao Ji and Changhao Jiang and Shuo Li and Senjie Jin and Sirui Song and Junke Wang and Boyang Hong and Lu Chen and Guodong Zheng and Ming Zhang and Caishuang Huang and Rui Zheng and Zhiheng Xi and Yuhao Zhou and Shihan Dou and Junjie Ye and Hang Yan and Tao Gui and Qi Zhang and Xipeng Qiu and Xuanjing Huang and Zuxuan Wu and Yu-Gang Jiang}, year = {2024}, url = {https://arxiv.org/abs/2401.17221}, note = {Source identifier: 2401.17221} }