@misc{indiciaeec51ed1f7cce, title = {TASTE: Text-Aligned Speech Tokenization and Embedding for Spoken Language Modeling}, author = {Liang-Hsuan Tseng and Yi-Chang Chen and Kuan-Yi Lee and Da-Shan Shiu and Hung-yi Lee}, year = {2026}, url = {https://arxiv.org/abs/2504.07053}, note = {Source identifier: 2504.07053} }