@misc{indiciae44ed0af1dc56, title = {Vision Transformers: From Semantic Segmentation to Dense Prediction}, author = {Li Zhang and Jiachen Lu and Sixiao Zheng and Xinxuan Zhao and Xiatian Zhu and Yanwei Fu and Tao Xiang and Jianfeng Feng and Philip H. S. Torr}, year = {2024}, doi = {10.1007/s11263-024-02173-w}, url = {https://arxiv.org/abs/2207.09339}, note = {Source identifier: 2207.09339} }