@misc{indiciaec54f9ca72b69, title = {Sieve: Multimodal Dataset Pruning Using Image Captioning Models}, author = {Anas Mahmoud and Mostafa Elhoushi and Amro Abbas and Yu Yang and Newsha Ardalani and Hugh Leather and Ari Morcos}, year = {2024}, url = {https://arxiv.org/abs/2310.02110}, note = {Source identifier: 2310.02110} }