@misc{indiciaea356da4ec7ac, title = {Rethinking Vision Transformer for Large-Scale Fine-Grained Image Retrieval}, author = {Xin Jiang and Hao Tang and Yonghua Pan and Zechao Li}, year = {2025}, url = {https://arxiv.org/abs/2504.16691}, note = {Source identifier: 2504.16691} }