@misc{indiciae12bc3df56f5d, title = {MeMViT: Memory-Augmented Multiscale Vision Transformer for Efficient Long-Term Video Recognition}, author = {Chao-Yuan Wu and Yanghao Li and Karttikeya Mangalam and Haoqi Fan and Bo Xiong and Jitendra Malik and Christoph Feichtenhofer}, year = {2022}, url = {https://arxiv.org/abs/2201.08383}, note = {Source identifier: 2201.08383} }