TY - RPRT TI - EVF-SAM: Early Vision-Language Fusion for Text-Prompted Segment Anything Model AU - Yuxuan Zhang AU - Tianheng Cheng AU - Lianghui Zhu AU - Rui Hu AU - Lei Liu AU - Heng Liu AU - Longjin Ran AU - Xiaoxin Chen AU - Wenyu Liu AU - Xinggang Wang PY - 2025 UR - https://arxiv.org/abs/2406.20076 ID - 2406.20076 ER -