TY - RPRT TI - Vision Search Assistant: Empower Vision-Language Models as Multimodal Search Engines AU - Zhixin Zhang AU - Yiyuan Zhang AU - Xiaohan Ding AU - Xiangyu Yue PY - 2024 UR - https://arxiv.org/abs/2410.21220 ID - 2410.21220 ER -