@misc{indiciae55645fd11700, title = {Vision-by-Language for Training-Free Compositional Image Retrieval}, author = {Shyamgopal Karthik and Karsten Roth and Massimiliano Mancini and Zeynep Akata}, year = {2024}, url = {https://arxiv.org/abs/2310.09291}, note = {Source identifier: 2310.09291} }