@misc{indiciae714b3f5bab3b, title = {Speech Token Prediction via Compressed-to-fine Language Modeling for Speech Generation}, author = {Wenrui Liu and Qian Chen and Wen Wang and Yafeng Chen and Jin Xu and Zhifang Guo and Guanrou Yang and Weiqin Li and Xiaoda Yang and Tao Jin and Minghui Fang and Jialong Zuo and Bai Jionghao and Zemin Liu}, year = {2025}, url = {https://arxiv.org/abs/2505.24496}, note = {Source identifier: 2505.24496} }