TY - RPRT TI - Learning Video Temporal Dynamics with Cross-Modal Attention for Robust Audio-Visual Speech Recognition AU - Sungnyun Kim AU - Kangwook Jang AU - Sangmin Bae AU - Hoirin Kim AU - Se-Young Yun PY - 2024 UR - https://arxiv.org/abs/2407.03563 ID - 2407.03563 ER -