@misc{indiciaec41940db0a5a, title = {From Pixels to Graphs: Open-Vocabulary Scene Graph Generation with Vision-Language Models}, author = {Rongjie Li and Songyang Zhang and Dahua Lin and Kai Chen and Xuming He}, year = {2024}, url = {https://arxiv.org/abs/2404.00906}, note = {Source identifier: 2404.00906} }