@misc{indiciae36668b71f12f, title = {Preserving Multi-Modal Capabilities of Pre-trained VLMs for Improving Vision-Linguistic Compositionality}, author = {Youngtaek Oh and Jae Won Cho and Dong-Jin Kim and In So Kweon and Junmo Kim}, year = {2024}, url = {https://arxiv.org/abs/2410.05210}, note = {Source identifier: 2410.05210} }