TY - RPRT TI - VEGA: Learning Interleaved Image-Text Comprehension in Vision-Language Large Models AU - Chenyu Zhou AU - Mengdan Zhang AU - Peixian Chen AU - Chaoyou Fu AU - Yunhang Shen AU - Xiawu Zheng AU - Xing Sun AU - Rongrong Ji PY - 2024 UR - https://arxiv.org/abs/2406.10228 ID - 2406.10228 ER -