@misc{indiciae9a94591a6c61, title = {SynesLM: A Unified Approach for Audio-visual Speech Recognition and Translation via Language Model and Synthetic Data}, author = {Yichen Lu and Jiaqi Song and Xuankai Chang and Hengwei Bian and Soumi Maiti and Shinji Watanabe}, year = {2024}, url = {https://arxiv.org/abs/2408.00624}, note = {Source identifier: 2408.00624} }