@misc{indiciae13cd26a49bfe, title = {Generative Audio Language Modeling with Continuous-valued Tokens and Masked Next-Token Prediction}, author = {Shu-wen Yang and Byeonggeun Kim and Kuan-Po Huang and Qingming Tang and Huy Phan and Bo-Ru Lu and Harsha Sundar and Shalini Ghosh and Hung-yi Lee and Chieh-Chi Kao and Chao Wang}, year = {2025}, url = {https://arxiv.org/abs/2507.09834}, note = {Source identifier: 2507.09834} }