TY - RPRT TI - HoVLE: Unleashing the Power of Monolithic Vision-Language Models with Holistic Vision-Language Embedding AU - Chenxin Tao AU - Shiqian Su AU - Xizhou Zhu AU - Chenyu Zhang AU - Zhe Chen AU - Jiawen Liu AU - Wenhai Wang AU - Lewei Lu AU - Gao Huang AU - Yu Qiao AU - Jifeng Dai PY - 2025 UR - https://arxiv.org/abs/2412.16158 ID - 2412.16158 ER -