@misc{indiciae5997f01b17ac, title = {Musketeer: Joint Training for Multi-task Vision Language Model with Task Explanation Prompts}, author = {Zhaoyang Zhang and Yantao Shen and Kunyu Shi and Zhaowei Cai and Jun Fang and Siqi Deng and Hao Yang and Davide Modolo and Zhuowen Tu and Stefano Soatto}, year = {2024}, url = {https://arxiv.org/abs/2305.07019}, note = {Source identifier: 2305.07019} }