TY - RPRT TI - Robust LLM-based Audio-Visual Speech Recognition with Sparse Modality Alignment and Visual Unit-Guided Refinement AU - Fei Su AU - Cancan Li AU - Juan Liu AU - Wei Ju AU - Hongbin Suo AU - Ming Li PY - 2026 UR - https://arxiv.org/abs/2603.03811 ID - 2603.03811 ER -