@misc{indiciaed1de7b4d1030, title = {SPOT! Revisiting Video-Language Models for Event Understanding}, author = {Gengyuan Zhang and Jinhe Bi and Jindong Gu and Yanyu Chen and Volker Tresp}, year = {2023}, url = {https://arxiv.org/abs/2311.12919}, note = {Source identifier: 2311.12919} }