@misc{indiciae72198b648d5f, title = {Punctuation-aware Hybrid Trainable Sparse Attention for Large Language Models}, author = {Junxiang Qiu and Shuo Wang and Zhengsu Chen and Hengheng Zhang and Jinda Lu and Changcheng Li and Qi Tian}, year = {2026}, url = {https://arxiv.org/abs/2601.02819}, note = {Source identifier: 2601.02819} }