TY - RPRT TI - CoAVT: A Cognition-Inspired Unified Audio-Visual-Text Pre-Training Model for Multimodal Processing AU - Xianghu Yue AU - Xiaohai Tian AU - Lu Lu AU - Malu Zhang AU - Zhizheng Wu AU - Haizhou Li PY - 2024 UR - https://arxiv.org/abs/2401.12264 ID - 2401.12264 ER -