TY - RPRT TI - Joint Visual and Text Prompting for Improved Object-Centric Perception with Multimodal Large Language Models AU - Songtao Jiang AU - Yan Zhang AU - Chenyi Zhou AU - Yeying Jin AU - Yang Feng AU - Jian Wu AU - Zuozhu Liu PY - 2024 UR - https://arxiv.org/abs/2404.04514 ID - 2404.04514 ER -