TY - RPRT TI - Video-LLaVA: Learning United Visual Representation by Alignment Before Projection AU - Bin Lin AU - Yang Ye AU - Bin Zhu AU - Jiaxi Cui AU - Munan Ning AU - Peng Jin AU - Li Yuan PY - 2024 UR - https://arxiv.org/abs/2311.10122 ID - 2311.10122 ER -