@misc{indiciae3981a3a71b27, title = {Valley2: Exploring Multimodal Models with Scalable Vision-Language Design}, author = {Ziheng Wu and Zhenghao Chen and Ruipu Luo and Can Zhang and Yuan Gao and Zhentao He and Xian Wang and Haoran Lin and Minghui Qiu}, year = {2025}, url = {https://arxiv.org/abs/2501.05901}, note = {Source identifier: 2501.05901} }