@misc{indiciae52f7c0404f54, title = {Video Event Reasoning and Prediction by Fusing World Knowledge from LLMs with Vision Foundation Models}, author = {L'ea Dubois and Klaus Schmidt and Chengyu Wang and Ji-Hoon Park and Lin Wang and Santiago Munoz}, year = {2025}, url = {https://arxiv.org/abs/2507.05822}, note = {Source identifier: 2507.05822} }