TY - RPRT TI - VQ-CTAP: Cross-Modal Fine-Grained Sequence Representation Learning for Speech Processing AU - Chunyu Qiang AU - Wang Geng AU - Yi Zhao AU - Ruibo Fu AU - Tao Wang AU - Cheng Gong AU - Tianrui Wang AU - Qiuyu Liu AU - Jiangyan Yi AU - Zhengqi Wen AU - Chen Zhang AU - Hao Che AU - Longbiao Wang AU - Jianwu Dang AU - Jianhua Tao PY - 2025 UR - https://arxiv.org/abs/2408.05758 ID - 2408.05758 ER -