@misc{indiciaeaf394ac30d6c, title = {Speaker consistency loss and step-wise optimization for semi-supervised joint training of TTS and ASR using unpaired text data}, author = {Naoki Makishima and Satoshi Suzuki and Atsushi Ando and Ryo Masumura}, year = {2022}, url = {https://arxiv.org/abs/2207.04659}, note = {Source identifier: 2207.04659} }