TY - RPRT TI - MLCA-AVSR: Multi-Layer Cross Attention Fusion based Audio-Visual Speech Recognition AU - He Wang AU - Pengcheng Guo AU - Pan Zhou AU - Lei Xie PY - 2024 DO - 10.1109/icassp48485.2024.10446769 UR - https://arxiv.org/abs/2401.03424 ID - 2401.03424 ER -