@misc{indiciae825b98c76594, title = {WESR: Scaling and Evaluating Word-level Event-Speech Recognition}, author = {Chenchen Yang and Kexin Huang and Liwei Fan and Qian Tu and Botian Jiang and Dong Zhang and Linqi Yin and Shimin Li and Zhaoye Fei and Qinyuan Cheng and Xipeng Qiu}, year = {2026}, url = {https://arxiv.org/abs/2601.04508}, note = {Source identifier: 2601.04508} }