@misc{indiciae67346338e92a, title = {Improving Cross-modal Alignment with Synthetic Pairs for Text-only Image Captioning}, author = {Zhiyue Liu and Jinyuan Liu and Fanrong Ma}, year = {2023}, url = {https://arxiv.org/abs/2312.08865}, note = {Source identifier: 2312.08865} }