@misc{indiciae708a9fc2dceb, title = {Exploring Efficient Foundational Multi-modal Models for Video Summarization}, author = {Karan Samel and Apoorva Beedu and Nitish Sontakke and Irfan Essa}, year = {2024}, url = {https://arxiv.org/abs/2410.07405}, note = {Source identifier: 2410.07405} }