TY - RPRT TI - LLaVA-VSD: Large Language-and-Vision Assistant for Visual Spatial Description AU - Yizhang Jin AU - Jian Li AU - Jiangning Zhang AU - Jianlong Hu AU - Zhenye Gan AU - Xin Tan AU - Yong Liu AU - Yabiao Wang AU - Chengjie Wang AU - Lizhuang Ma PY - 2024 UR - https://arxiv.org/abs/2408.04957 ID - 2408.04957 ER -