TY - RPRT TI - Learning CLIP Guided Visual-Text Fusion Transformer for Video-based Pedestrian Attribute Recognition AU - Jun Zhu AU - Jiandong Jin AU - Zihan Yang AU - Xiaohao Wu AU - Xiao Wang PY - 2023 UR - https://arxiv.org/abs/2304.10091 ID - 2304.10091 ER -