@misc{indiciaefc5fa90e569b, title = {SLM-S2ST: A multimodal language model for direct speech-to-speech translation}, author = {Yuxuan Hu and Haibin Wu and Ruchao Fan and Xiaofei Wang and Heng Lu and Yao Qian and Jinyu Li}, year = {2026}, url = {https://arxiv.org/abs/2506.04392}, note = {Source identifier: 2506.04392} }