TY - RPRT TI - Learning Contextually Fused Audio-visual Representations for Audio-visual Speech Recognition AU - Zi-Qiang Zhang AU - Jie Zhang AU - Jian-Shu Zhang AU - Ming-Hui Wu AU - Xin Fang AU - Li-Rong Dai PY - 2022 UR - https://arxiv.org/abs/2202.07428 ID - 2202.07428 ER -