@misc{indiciae0368930ecece, title = {Can We Achieve High-quality Direct Speech-to-Speech Translation without Parallel Speech Data?}, author = {Qingkai Fang and Shaolei Zhang and Zhengrui Ma and Min Zhang and Yang Feng}, year = {2024}, url = {https://arxiv.org/abs/2406.07289}, note = {Source identifier: 2406.07289} }