@misc{indiciaea2940f861e6c, title = {Griffon-G: Bridging Vision-Language and Vision-Centric Tasks via Large Multimodal Models}, author = {Yufei Zhan and Hongyin Zhao and Yousong Zhu and Fan Yang and Ming Tang and Jinqiao Wang}, year = {2024}, url = {https://arxiv.org/abs/2410.16163}, note = {Source identifier: 2410.16163} }