TY - RPRT TI - UniTAB: Unifying Text and Box Outputs for Grounded Vision-Language Modeling AU - Zhengyuan Yang AU - Zhe Gan AU - Jianfeng Wang AU - Xiaowei Hu AU - Faisal Ahmed AU - Zicheng Liu AU - Yumao Lu AU - Lijuan Wang PY - 2022 UR - https://arxiv.org/abs/2111.12085 ID - 2111.12085 ER -