@misc{indiciae4fc855db13f5, title = {Continuous-Token Diffusion for Speaker-Referenced TTS in Multimodal LLMs}, author = {Xinlu He and Swayambhu Nath Ray and Harish Mallidi and Jia-Hong Huang and Ashwin Bellur and Chander Chandak and M. Maruf and Venkatesh Ravichandran}, year = {2025}, url = {https://arxiv.org/abs/2510.12995}, note = {Source identifier: 2510.12995} }