@misc{indiciae2082d306c67c, title = {VLT: Vision-Language Transformer and Query Generation for Referring Segmentation}, author = {Henghui Ding and Chang Liu and Suchen Wang and Xudong Jiang}, year = {2022}, doi = {10.1109/tpami.2022.3217852}, url = {https://arxiv.org/abs/2210.15871}, note = {Source identifier: 2210.15871} }