@misc{indiciaefef6dfe3aab2, title = {Equivariant Similarity for Vision-Language Foundation Models}, author = {Tan Wang and Kevin Lin and Linjie Li and Chung-Ching Lin and Zhengyuan Yang and Hanwang Zhang and Zicheng Liu and Lijuan Wang}, year = {2023}, url = {https://arxiv.org/abs/2303.14465}, note = {Source identifier: 2303.14465} }