TY - RPRT TI - Enhancing Multimodal Understanding with CLIP-Based Image-to-Text Transformation AU - Chang Che AU - Qunwei Lin AU - Xinyu Zhao AU - Jiaxin Huang AU - Liqiang Yu PY - 2024 UR - https://arxiv.org/abs/2401.06167 ID - 2401.06167 ER -