@misc{indiciae765150f1f733, title = {TransVOD: End-to-End Video Object Detection with Spatial-Temporal Transformers}, author = {Qianyu Zhou and Xiangtai Li and Lu He and Yibo Yang and Guangliang Cheng and Yunhai Tong and Lizhuang Ma and Dacheng Tao}, year = {2022}, doi = {10.1109/tpami.2022.3223955}, url = {https://arxiv.org/abs/2201.05047}, note = {Source identifier: 2201.05047} }