TY - RPRT TI - PixCLIP: Achieving Fine-grained Visual Language Understanding via Any-granularity Pixel-Text Alignment Learning AU - Yicheng Xiao AU - Yu Chen AU - Haoxuan Ma AU - Jiale Hong AU - Caorui Li AU - Lingxiang Wu AU - Haiyun Guo AU - Jinqiao Wang PY - 2025 UR - https://arxiv.org/abs/2511.04601 ID - 2511.04601 ER -