@misc{indiciae79f6aa0dca2e, title = {Tag2Text: Guiding Vision-Language Model via Image Tagging}, author = {Xinyu Huang and Youcai Zhang and Jinyu Ma and Weiwei Tian and Rui Feng and Yuejie Zhang and Yaqian Li and Yandong Guo and Lei Zhang}, year = {2024}, url = {https://arxiv.org/abs/2303.05657}, note = {Source identifier: 2303.05657} }