@misc{indiciae633a9198a05b, title = {VocalNet: Speech LLM with Multi-Token Prediction for Faster and High-Quality Generation}, author = {Yuhao Wang and Heyang Liu and Ziyang Cheng and Ronghua Wu and Qunshan Gu and Yanfeng Wang and Yu Wang}, year = {2025}, url = {https://arxiv.org/abs/2504.04060}, note = {Source identifier: 2504.04060} }