TY - RPRT TI - VL-DINO: Leveraging CLIP Vision-Language Knowledge for Open-Vocabulary Object Detectio AU - Hao Zhang AU - Qinran Lin AU - Linqi Song AU - Yong Li PY - 2026 UR - https://arxiv.org/abs/2606.11546 ID - 2606.11546 ER -