@misc{indiciae4ff07152d6eb, title = {OST: Refining Text Knowledge with Optimal Spatio-Temporal Descriptor for General Video Recognition}, author = {Tongjia Chen and Hongshan Yu and Zhengeng Yang and Zechuan Li and Wei Sun and Chen Chen}, year = {2024}, url = {https://arxiv.org/abs/2312.00096}, note = {Source identifier: 2312.00096} }