@misc{indiciae8e70c5da9c6d, title = {Enhancing Vision-Language Pre-Training with Jointly Learned Questioner and Dense Captioner}, author = {Zikang Liu and Sihan Chen and Longteng Guo and Handong Li and Xingjian He and Jing Liu}, year = {2023}, url = {https://arxiv.org/abs/2305.11769}, note = {Source identifier: 2305.11769} }