@misc{indiciae5015b50ba2c7, title = {Not Only Text: Exploring Compositionality of Visual Representations in Vision-Language Models}, author = {Davide Berasi and Matteo Farina and Massimiliano Mancini and Elisa Ricci and Nicola Strisciuglio}, year = {2025}, url = {https://arxiv.org/abs/2503.17142}, note = {Source identifier: 2503.17142} }