@misc{indiciae99251488a988, title = {SpargeAttention2: Trainable Sparse Attention via Hybrid Top-k+Top-p Masking and Distillation Fine-Tuning}, author = {Jintao Zhang and Kai Jiang and Chendong Xiang and Weiqi Feng and Yuezhou Hu and Haocheng Xi and Jianfei Chen and Jun Zhu}, year = {2026}, url = {https://arxiv.org/abs/2602.13515}, note = {Source identifier: 2602.13515} }