@misc{indiciaef1c9ba6183b5, title = {Highly Controllable Diffusion-based Any-to-Any Voice Conversion Model with Frame-level Prosody Feature}, author = {Kyungguen Byun and Sunkuk Moon and Erik Visser}, year = {2023}, url = {https://arxiv.org/abs/2309.03364}, note = {Source identifier: 2309.03364} }