TY - RPRT TI - Mask-aware Text-to-Image Retrieval: Referring Expression Segmentation Meets Cross-modal Retrieval AU - Li-Cheng Shen AU - Jih-Kang Hsieh AU - Wei-Hua Li AU - Chu-Song Chen PY - 2025 UR - https://arxiv.org/abs/2506.22864 ID - 2506.22864 ER -