@misc{indiciae7d53d43253b8, title = {Superpixel Semantics Representation and Pre-training for Vision-Language Task}, author = {Siyu Zhang and Yeming Chen and Yaoru Sun and Fang Wang and Jun Yang and Lizhi Bai and Shangce Gao}, year = {2024}, url = {https://arxiv.org/abs/2310.13447}, note = {Source identifier: 2310.13447} }