@misc{indiciae0eee7dc6358a, title = {LAViTeR: Learning Aligned Visual and Textual Representations Assisted by Image and Caption Generation}, author = {Mohammad Abuzar Hashemi and Zhanghexuan Li and Mihir Chauhan and Yan Shen and Abhishek Satbhai and Mir Basheer Ali and Mingchen Gao and Sargur Srihari}, year = {2024}, url = {https://arxiv.org/abs/2109.04993}, note = {Source identifier: 2109.04993} }