@misc{indiciae610afc26e427, title = {LLaVA-SG: Leveraging Scene Graphs as Visual Semantic Expression in Vision-Language Models}, author = {Jingyi Wang and Jianzhong Ju and Jian Luan and Zhidong Deng}, year = {2024}, url = {https://arxiv.org/abs/2408.16224}, note = {Source identifier: 2408.16224} }