TY - RPRT TI - Q: How to Specialize Large Vision-Language Models to Data-Scarce VQA Tasks? A: Self-Train on Unlabeled Images! AU - Zaid Khan AU - Vijay Kumar BG AU - Samuel Schulter AU - Xiang Yu AU - Yun Fu AU - Manmohan Chandraker PY - 2023 UR - https://arxiv.org/abs/2306.03932 ID - 2306.03932 ER -