TY - RPRT TI - Benchmarking Large Vision-Language Models via Directed Scene Graph for Comprehensive Image Captioning AU - Fan Lu AU - Wei Wu AU - Kecheng Zheng AU - Shuailei Ma AU - Biao Gong AU - Jiawei Liu AU - Wei Zhai AU - Yang Cao AU - Yujun Shen AU - Zheng-Jun Zha PY - 2025 UR - https://arxiv.org/abs/2412.08614 ID - 2412.08614 ER -