@misc{indiciaeac5b9bcbad07, title = {MLLM-Guided VLM Fine-Tuning with Joint Inference for Zero-Shot Composed Image Retrieval}, author = {Rong-Cheng Tu and Zhao Jin and Jingyi Liao and Xiao Luo and Yingjie Wang and Li Shen and Dacheng Tao}, year = {2025}, url = {https://arxiv.org/abs/2505.19707}, note = {Source identifier: 2505.19707} }