@misc{indiciaef4f59c27dbd8, title = {Enhancing Video Transformers for Action Understanding with VLM-aided Training}, author = {Hui Lu and Hu Jian and Ronald Poppe and Albert Ali Salah}, year = {2024}, url = {https://arxiv.org/abs/2403.16128}, note = {Source identifier: 2403.16128} }