TY - RPRT TI - Large Language Models are Strong Audio-Visual Speech Recognition Learners AU - Umberto Cappellazzo AU - Minsu Kim AU - Honglie Chen AU - Pingchuan Ma AU - Stavros Petridis AU - Daniele Falavigna AU - Alessio Brutti AU - Maja Pantic PY - 2025 UR - https://arxiv.org/abs/2409.12319 ID - 2409.12319 ER -