@misc{indiciaef462aaee5514, title = {SwinBERT: End-to-End Transformers with Sparse Attention for Video Captioning}, author = {Kevin Lin and Linjie Li and Chung-Ching Lin and Faisal Ahmed and Zhe Gan and Zicheng Liu and Yumao Lu and Lijuan Wang}, year = {2022}, url = {https://arxiv.org/abs/2111.13196}, note = {Source identifier: 2111.13196} }