@misc{indiciae399af18557f6, title = {Augmenting Vision Language Pretraining by Learning Codebook with Visual Semantics}, author = {Xiaoyuan Guo and Jiali Duan and C. -C. Jay Kuo and Judy Wawira Gichoya and Imon Banerjee}, year = {2022}, url = {https://arxiv.org/abs/2208.00475}, note = {Source identifier: 2208.00475} }