@misc{indiciaef765bc60dee6, title = {Rethinking Length-Based Training: Batch Composition and Loss Normalization in Speech Token Language Models}, author = {Hongjin Song and Runwu Shi and Weiqiao Shan and Jiale Luo and Yujin Wang and Yifei Wu and Chunxiang Jin}, year = {2026}, url = {https://arxiv.org/abs/2609.25890}, note = {Source identifier: 2609.25890} }