@misc{indiciae9228aa628308, title = {Visual Transformers: Token-based Image Representation and Processing for Computer Vision}, author = {Bichen Wu and Chenfeng Xu and Xiaoliang Dai and Alvin Wan and Peizhao Zhang and Zhicheng Yan and Masayoshi Tomizuka and Joseph Gonzalez and Kurt Keutzer and Peter Vajda}, year = {2020}, url = {https://arxiv.org/abs/2006.03677}, note = {Source identifier: 2006.03677} }