@misc{indiciaecdea82d56879, title = {Tagging before Alignment: Integrating Multi-Modal Tags for Video-Text Retrieval}, author = {Yizhen Chen and Jie Wang and Lijian Lin and Zhongang Qi and Jin Ma and Ying Shan}, year = {2023}, url = {https://arxiv.org/abs/2301.12644}, note = {Source identifier: 2301.12644} }