TY - RPRT TI - Leopard: A Vision Language Model For Text-Rich Multi-Image Tasks AU - Mengzhao Jia AU - Wenhao Yu AU - Kaixin Ma AU - Tianqing Fang AU - Zhihan Zhang AU - Siru Ouyang AU - Hongming Zhang AU - Dong Yu AU - Meng Jiang PY - 2025 UR - https://arxiv.org/abs/2410.01744 ID - 2410.01744 ER -