@misc{indiciae49af3aa76e28, title = {Mining Fine-Grained Image-Text Alignment for Zero-Shot Captioning via Text-Only Training}, author = {Longtian Qiu and Shan Ning and Xuming He}, year = {2024}, url = {https://arxiv.org/abs/2401.02347}, note = {Source identifier: 2401.02347} }