@misc{indiciae6762896007bb, title = {Are Multimodal Large Language Models Good Annotators for Image Tagging?}, author = {Ming-Kun Xie and Jia-Hao Xiao and Zhiqiang Kou and Zhongnian Li and Gang Niu and Masashi Sugiyama}, year = {2026}, url = {https://arxiv.org/abs/2602.20972}, note = {Source identifier: 2602.20972} }