@misc{indiciae9d29575babed, title = {Food-500 Cap: A Fine-Grained Food Caption Benchmark for Evaluating Vision-Language Models}, author = {Zheng Ma and Mianzhi Pan and Wenhan Wu and Kanzhi Cheng and Jianbing Zhang and Shujian Huang and Jiajun Chen}, year = {2023}, url = {https://arxiv.org/abs/2308.03151}, note = {Source identifier: 2308.03151} }