@misc{indiciae74796be06320, title = {CACARA: Cross-Modal Alignment Leveraging a Text-Centric Approach for Cost-Effective Multimodal and Multilingual Learning}, author = {Diego A. B. Moreira and Alef I. Ferreira and Jhessica Silva and Gabriel O. dos Santos and Gustavo Bonil and João Gondim and Marina dos Santos and Helena Maia and Simone Hashiguti and Nádia da Silva and Carolina Scarton and Helio Pedrini and Sandra Avila}, year = {2025}, url = {https://arxiv.org/abs/2512.00496}, note = {Source identifier: 2512.00496} }