@misc{indiciae851f6203e014, title = {RTQ: Rethinking Video-language Understanding Based on Image-text Model}, author = {Xiao Wang and Yaoyu Li and Tian Gan and Zheng Zhang and Jingjing Lv and Liqiang Nie}, year = {2023}, doi = {10.1145/3581783.3612152}, url = {https://arxiv.org/abs/2312.00347}, note = {Source identifier: 2312.00347} }