@misc{indiciaed9ed755327ec, title = {Efficient Video Transformers with Spatial-Temporal Token Selection}, author = {Junke Wang and Xitong Yang and Hengduo Li and Li Liu and Zuxuan Wu and Yu-Gang Jiang}, year = {2022}, url = {https://arxiv.org/abs/2111.11591}, note = {Source identifier: 2111.11591} }