TY - RPRT TI - OTTER: Open-Tagging via Text-Image Representation for Multi-modal Understanding AU - Jieer Ouyang AU - Xiaoneng Xiang AU - Zheng Wang AU - Yangkai Ding PY - 2025 UR - https://arxiv.org/abs/2510.00652 ID - 2510.00652 ER -