@misc{indiciae78b6f4a5b6f6, title = {CrossViT: Cross-Attention Multi-Scale Vision Transformer for Image Classification}, author = {Chun-Fu Chen and Quanfu Fan and Rameswar Panda}, year = {2021}, url = {https://arxiv.org/abs/2103.14899}, note = {Source identifier: 2103.14899} }