TY - RPRT TI - HiMo-CLIP: Modeling Semantic Hierarchy and Monotonicity in Vision-Language Alignment AU - Ruijia Wu AU - Ping Chen AU - Fei Shen AU - Shaoan Zhao AU - Qiang Hui AU - Huanlin Gao AU - Ting Lu AU - Zhaoxiang Liu AU - Fang Zhao AU - Kai Wang AU - Shiguo Lian PY - 2025 UR - https://arxiv.org/abs/2511.06653 ID - 2511.06653 ER -