TY - RPRT TI - MSRS: Training Multimodal Speech Recognition Models from Scratch with Sparse Mask Optimization AU - Adriana Fernandez-Lopez AU - Honglie Chen AU - Pingchuan Ma AU - Lu Yin AU - Qiao Xiao AU - Stavros Petridis AU - Shiwei Liu AU - Maja Pantic PY - 2024 UR - https://arxiv.org/abs/2406.17614 ID - 2406.17614 ER -