TY - RPRT TI - VL-CLIP: Enhancing Multimodal Recommendations via Visual Grounding and LLM-Augmented CLIP Embeddings AU - Ramin Giahi AU - Kehui Yao AU - Sriram Kollipara AU - Kai Zhao AU - Vahid Mirjalili AU - Jianpeng Xu AU - Topojoy Biswas AU - Evren Korpeoglu AU - Kannan Achan PY - 2025 UR - https://arxiv.org/abs/2507.17080 ID - 2507.17080 ER -