@misc{indiciae784b089cdac1, title = {Batched Speech Decisions Without Decoding: Single-Token Supervision Lets a Frozen LLM Hear Beyond the Transcript}, author = {Jie Jin and Ziyin Ma and Min Yin and Jinyu Chen and Haigang Song and Zhikun Pang and Xiaowen Zhang}, year = {2026}, url = {https://arxiv.org/abs/2610.02638}, note = {Source identifier: 2610.02638} }