@misc{indiciaeb342a62ba046, title = {Adaptive Audio-Visual Speech Recognition via Matryoshka-Based Multimodal LLMs}, author = {Umberto Cappellazzo and Minsu Kim and Stavros Petridis}, year = {2025}, url = {https://arxiv.org/abs/2503.06362}, note = {Source identifier: 2503.06362} }