@misc{indiciaeb2aa04e9d010, title = {Audio is all in one: speech-driven gesture synthetics using WavLM pre-trained model}, author = {Fan Zhang and Naye Ji and Fuxing Gao and Siyuan Zhao and Zhaohan Wang and Shunman Li}, year = {2024}, url = {https://arxiv.org/abs/2308.05995}, note = {Source identifier: 2308.05995} }