@misc{indiciae4bbd31c60d0e, title = {Unlocking Full Efficiency of Token Filtering in Large Language Model Training}, author = {Di Chai and Pengbo Li and Feiyuan Zhang and Yilun Jin and Han Tian and Kaiqiang Xu and Binhang Yuan and Dian Shen and Junxue Zhang and Kai Chen}, year = {2026}, url = {https://arxiv.org/abs/2502.00340}, note = {Source identifier: 2502.00340} }